POST
Создать речь

Authorizations

Authorization
string
header
required

API-ключ в качестве токена носителя в заголовке авторизации

Body

application/json

Ввод запроса преобразования текста в речь

input
string
required

Текст для синтеза

Example:

"Hello world"

model
string
required

идентификатор модели TTS

Example:

"mistralai/voxtral-mini-tts-2603"

input_references
object[]

Справочный контент для клонирования голоса без сохранения состояния: одна часть input_audio, содержащая образец голоса, опционально сопровождаемая одной частью text с ее расшифровкой. Маршрутизируется только на эндпоинты, поддерживающие клонирование голоса.

Справочная часть содержимого для клонирования голоса без сохранения состояния

Example:
Example:
provider
object

Конфигурация транзитной передачи для конкретного поставщика

response_format
enum<string>
default:pcm

Формат вывода звука

Available options:
mp3,
pcm
Example:

"pcm"

speed
number<double>

Множитель скорости воспроизведения. Используется только моделями, которые его поддерживают (например, OpenAI TTS). Игнорируется другими провайдерами.

Example:

1

voice
string

Голосовой идентификатор (зависит от провайдера).

Minimum string length: 1
Example:

"en_paul_neutral"

Response

Поток аудиобайтов

Необработанный байтовый поток аудио. Тип контента зависит от запрошенного формата (audio/mpeg для mp3, audio/pcm для pcm — 16-битный прямой порядок байтов).