Skip to main content
Быстрая модель синтеза речи (text-to-speech) от ElevenLabs. Текст до 5000 символов, выбор голоса, скорость 0.7–1.2 (на dedicated-эндпоинте /v1/audio/speech — 0.25–4.0), опциональные временные метки и контекст (previous_text, next_text). Единственная модель, поддерживающая language_code.
Рекомендуем использовать dedicated-эндпоинт Audio Speech — там доступен полный диапазон speed и согласованный набор ElevenLabs-параметров.

Обзор

Параметры

Пример запроса (cURL)

Аудио возвращается как base64-строка в поле audio (не бинарный поток). Декодируйте и сохраняйте с расширением по contentType (например, audio/mpeg.mp3).