О модели#
GLM TTS генерирует речь из текста через /v1/audio/speech. Это удобный вариант для короткой озвучки, голосовых ответов и автоматизации, где клиенту нужен готовый аудиофайл без polling.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 4 096 токенов |
Максимальная длина вывода | 4 096 токенов |
Мультимодальность | Текст в речь |
Дата выхода | 11 декабря 2025 |
Возможности#
Сценарий | Как использовать |
|---|---|
озвучка коротких сообщений и системных уведомлений | Подходит для production и прототипов |
голосовые ответы ассистента или customer support бота | Подходит для production и прототипов |
генерация аудио для тестов, демо и внутренних инструментов | Подходит для production и прототипов |
Что важно знать#
Ответ является бинарным аудио. Не пытайтесь парсить его как JSON.
Формат выбирается через response_format, например wav или mp3.
Стоимость зависит от длины входного текста.
Стоимость#
Что тарифицируется | Цена |
|---|---|
Синтез речи за 1 символ | 0.0031 руб |
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в SDK или прямых HTTP-запросах. Модель: glm-tts.
3. Для OpenAI-compatible SDK смотрите platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/audio/speech \
-H "Authorization: Bearer $DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "glm-tts", "input": "Привет, это короткая проверка синтеза речи.", "voice": "alloy", "response_format": "wav"}' \
--output speech.wavЭндпоинт#
Синтезирует речь и возвращает аудиофайл в том же HTTP-ответе.
POST https://api.dslab.tech/v1/audio/speech
Поле | Значение |
|---|---|
Authorization |
|
Content-Type |
|
Model |
|
Режим |
|
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| string | - | Точный slug модели |
| string | - | Текст для озвучки |
| string | alloy | Голос |
| string | wav | Формат аудио: wav или mp3 |



