← К блогу
Гайды23 июля 2026 г.

API для перевода речи: STT, TTS и перевод текста в одном сервисе

API для перевода речи: STT, TTS и перевод текста в одном сервисе

Когда продукту нужен голосовой перевод, задача быстро перестаёт быть одним запросом к модели. Нужно распознать речь, определить язык, перевести текст, синтезировать аудио и связать всё это в поток, который не развалится во время живого разговора.

Loquora API даёт эти возможности через единый ключ организации: отдельные REST-методы для текста и аудио, а также WebSocket для перевода в реальном времени.

Какие задачи закрывает API

API состоит из четырёх основных частей:

  • перевод текста между поддерживаемыми языками;
  • распознавание речи из WAV-файла;
  • синтез речи в MP3;
  • полный голосовой пайплайн через WebSocket: распознавание → перевод → озвучка.

Это можно использовать во внутренних инструментах международной команды, голосовых ботах, службах поддержки, CRM, образовательных продуктах и сервисах для обработки звонков.

Перевод текста

Метод POST /v1/translate принимает текст длиной до 5000 символов, исходный и целевой языки. В ответе приходит переведённый текст и использованная языковая пара.

curl https://api.loquora.space/v1/translate \
  -H "X-Api-Key: lq_your_key" \
  -H "Content-Type: application/json" \
  -d '{"text":"Привет!","source_lang":"ru","target_lang":"en"}'

Перевод текста не расходует баланс минут организации, поэтому подходит для интерфейсов, сообщений и коротких документов.

Распознавание речи

Метод POST /v1/stt принимает WAV-файл размером до 25 МБ. Язык можно передать явно или не указывать, чтобы включить автоматическое определение.

Ответ содержит распознанный текст, код языка, уверенность определения и длительность аудио. Именно длительность списывается из общего пула организации.

Синтез речи

Метод POST /v1/tts превращает текст в MP3. Можно использовать голос по умолчанию или разрешённый клонированный голос участника организации. В заголовке ответа возвращается длительность созданного аудио — она учитывается в расходе минут.

Клонированные голоса ограничены организацией: ключ не может запросить чужой голос по случайному voice_id.

Перевод в реальном времени через WebSocket

Для живого разговора доступен wss://api.loquora.space/ws. API-ключ передаётся как token в событии session.init, после чего интеграция работает с тем же потоковым протоколом, который использует Loquora.

{
  "type": "session.init",
  "payload": {
    "token": "lq_your_key",
    "sourceCode": "ru",
    "targetCode": "en"
  }
}

Такой режим подходит для звонков, голосовых ассистентов и других сценариев, где недостаточно загрузить готовый файл и дождаться ответа.

Как устроены API-ключи

Ключи принадлежат организации на тарифе Business. Создавать и отзывать их могут владелец и администраторы команды в приложении Loquora.

Полный ключ показывается только один раз после создания. В дальнейшем в интерфейсе остаётся короткий префикс, дата последнего использования, срок действия и статус. Если ключ мог попасть в чужие руки, его нужно отозвать и создать новый.

Один ключ ограничен 120 запросами в минуту. При превышении лимита API отвечает кодом 429 и передаёт Retry-After.

С чего начать

  1. Откройте настройки команды в приложении Loquora.
  2. Создайте API-ключ и сразу сохраните его в безопасном месте.
  3. Отправьте тестовый запрос к /v1/translate.
  4. Для аудио подключите /v1/stt, /v1/tts или WebSocket в зависимости от сценария.

Полное описание методов, авторизации и ошибок доступно в документации Loquora API.

Обновлено 23 июля 2026 г.2 просмотров