API для перевода речи: STT, TTS и перевод текста в одном сервисе

Когда продукту нужен голосовой перевод, задача быстро перестаёт быть одним запросом к модели. Нужно распознать речь, определить язык, перевести текст, синтезировать аудио и связать всё это в поток, который не развалится во время живого разговора.
Loquora API даёт эти возможности через единый ключ организации: отдельные REST-методы для текста и аудио, а также WebSocket для перевода в реальном времени.
Какие задачи закрывает API
API состоит из четырёх основных частей:
- перевод текста между поддерживаемыми языками;
- распознавание речи из WAV-файла;
- синтез речи в MP3;
- полный голосовой пайплайн через WebSocket: распознавание → перевод → озвучка.
Это можно использовать во внутренних инструментах международной команды, голосовых ботах, службах поддержки, CRM, образовательных продуктах и сервисах для обработки звонков.
Перевод текста
Метод POST /v1/translate принимает текст длиной до 5000 символов, исходный и целевой языки. В ответе приходит переведённый текст и использованная языковая пара.
curl https://api.loquora.space/v1/translate \
-H "X-Api-Key: lq_your_key" \
-H "Content-Type: application/json" \
-d '{"text":"Привет!","source_lang":"ru","target_lang":"en"}'
Перевод текста не расходует баланс минут организации, поэтому подходит для интерфейсов, сообщений и коротких документов.
Распознавание речи
Метод POST /v1/stt принимает WAV-файл размером до 25 МБ. Язык можно передать явно или не указывать, чтобы включить автоматическое определение.
Ответ содержит распознанный текст, код языка, уверенность определения и длительность аудио. Именно длительность списывается из общего пула организации.
Синтез речи
Метод POST /v1/tts превращает текст в MP3. Можно использовать голос по умолчанию или разрешённый клонированный голос участника организации. В заголовке ответа возвращается длительность созданного аудио — она учитывается в расходе минут.
Клонированные голоса ограничены организацией: ключ не может запросить чужой голос по случайному voice_id.
Перевод в реальном времени через WebSocket
Для живого разговора доступен wss://api.loquora.space/ws. API-ключ передаётся как token в событии session.init, после чего интеграция работает с тем же потоковым протоколом, который использует Loquora.
{
"type": "session.init",
"payload": {
"token": "lq_your_key",
"sourceCode": "ru",
"targetCode": "en"
}
}
Такой режим подходит для звонков, голосовых ассистентов и других сценариев, где недостаточно загрузить готовый файл и дождаться ответа.
Как устроены API-ключи
Ключи принадлежат организации на тарифе Business. Создавать и отзывать их могут владелец и администраторы команды в приложении Loquora.
Полный ключ показывается только один раз после создания. В дальнейшем в интерфейсе остаётся короткий префикс, дата последнего использования, срок действия и статус. Если ключ мог попасть в чужие руки, его нужно отозвать и создать новый.
Один ключ ограничен 120 запросами в минуту. При превышении лимита API отвечает кодом 429 и передаёт Retry-After.
С чего начать
- Откройте настройки команды в приложении Loquora.
- Создайте API-ключ и сразу сохраните его в безопасном месте.
- Отправьте тестовый запрос к
/v1/translate. - Для аудио подключите
/v1/stt,/v1/ttsили WebSocket в зависимости от сценария.
Полное описание методов, авторизации и ошибок доступно в документации Loquora API.