Технология преобразования текста в речь (TTS) от Soniox теперь доступна для Telnyx Voice AI. В каталог голосовых провайдеров добавлено около 200 голосов, каждый из которых поддерживает 60 языков в рамках одной модели.
Что нового
- Провайдер Soniox TTS: выбирайте голоса Soniox, используя формат Soniox.tts-rt-v2.<Name>. В каталоге представлено около 200 голосов, включая Soniox.tts-rt-v2.Adrian, Soniox.tts-rt-v2.Emma и Soniox.tts-rt-v2.Nina.
- 60 языков в одной модели: каждый голос Soniox поддерживает все доступные языки, включая английский, испанский, французский, немецкий, португальский, хинди, японский и арабский. Установите язык, используя двухбуквенный код ISO 639-1 (по умолчанию используется en). В Voice AI Assistants один и тот же голос продолжает общение, если вызывающий абонент меняет язык во время звонка.
- Точное воспроизведение буквенно-цифровых данных: модель Soniox была разработана для точного озвучивания номеров телефонов, адресов электронной почты, идентификаторов, проверочных кодов и номеров счетов.
- Потоковый синтез с низкой задержкой: передавайте речь через WebSocket или REST с использованием стандартных для телефонии форматов вывода 8 кГц pcm_mulaw и pcm_alaw.
- Доступность во всех голосовых сервисах Telnyx: используйте голоса Soniox в Voice AI Assistants, API Telnyx TTS (POST /v2/text-to-speech/speech и потоковая передача через WebSocket), командах Call Control (speak, gather_using_speak, conference speak) и TeXML <Say>.
- Управление скоростью и темпом: установите скорость в диапазоне от 0.7 до 1.3 и используйте параметр reduce_silence для сокращения пауз между словами.
- Ввод обычного текста: пишите подсказки обычным текстом. SSML не поддерживается, а длительность каждого запроса ограничена 2 минутами аудио.
Почему это важно
- Telnyx — это инфраструктура, на которой работают голосовые агенты: телефония, STT (распознавание речи), TTS и оркестрация агентов на одной платформе, вместо использования «Франкенштейна» из четырех-шести разных поставщиков.
- Soniox STT уже доступен на Telnyx, поэтому команды теперь могут реализовать обе стороны диалога — прослушивание и речь — с помощью одного провайдера речевого ИИ.
- Каждый голос поддерживает все языки, поэтому команды могут создать одного агента, который обслуживает звонящих на 60 языках без необходимости переключения моделей или смены голоса для каждого языка.
- Команды, работающие на нескольких рынках, могут предоставить агенту один и тот же голос для всех регионов, вместо того чтобы выбирать разные голоса или поставщиков для каждого языка.
Примеры использования
- Службы поддержки, которые зачитывают проверочные коды, номера счетов и контактные данные с точным воспроизведением буквенно-цифровых символов.
- Глобальные контакт-центры, обслуживающие звонящих на 60 языках с использованием одного голоса, включая разговоры на смешанных языках.
- Разработчики, создающие разговорных агентов, которые сочетают Soniox STT с Soniox TTS для обеспечения стабильного качества речи при распознавании и синтезе.
- Продуктовые команды, добавляющие голоса в сценарии вызовов Call Control или TeXML без необходимости подключения еще одного поставщика в стек.
Начало работы
- В Mission Control перейдите в раздел AI, затем Assistants и выберите своего помощника.
- Откройте вкладку Voice.
- Выберите Soniox в качестве провайдера и подберите голос.
- Сохраните настройки помощника и протестируйте его с реальным аудио звонящего перед запуском в продакшн.
Для сценариев вызовов на основе API передавайте голос Soniox в запросе POST /v2/text-to-speech/speech, через потоковую передачу WebSocket или в вызове Call Control/TeXML. Установите язык в соответствии с языком текста. Soniox предоставляет полный список поддерживаемых языков. Пример REST-запроса:
В TeXML установите голос и язык в теге <Say>:
Узнайте больше в документации провайдера Soniox, каталоге доступных голосов или обзоре Telnyx Text-to-Speech.



