Создать речь
Синтезирует звук из входного текста. Возвращает необработанный байтовый поток аудио в запрошенном формате (например, mp3, pcm, wav).
Authorizations
API-ключ в качестве токена носителя в заголовке авторизации
Body
Ввод запроса преобразования текста в речь
Текст для синтеза
"Hello world"
идентификатор модели TTS
"mistralai/voxtral-mini-tts-2603"
Справочный контент для клонирования голоса без сохранения состояния: одна часть input_audio, содержащая образец голоса, опционально сопровождаемая одной частью text с ее расшифровкой. Маршрутизируется только на эндпоинты, поддерживающие клонирование голоса.
Справочная часть содержимого для клонирования голоса без сохранения состояния
- Option 1
- Option 2
Конфигурация транзитной передачи для конкретного поставщика
Формат вывода звука
mp3, pcm "pcm"
Множитель скорости воспроизведения. Используется только моделями, которые его поддерживают (например, OpenAI TTS). Игнорируется другими провайдерами.
1
Голосовой идентификатор (зависит от провайдера).
1"en_paul_neutral"
Response
Поток аудиобайтов
Необработанный байтовый поток аудио. Тип контента зависит от запрошенного формата (audio/mpeg для mp3, audio/pcm для pcm — 16-битный прямой порядок байтов).