О модели#
GLM-4.7 Flash - легковесная и эффективная MoE-модель от Zhipu AI (Z.ai) с архитектурой 30B-A3B. Разработана как доступная версия GLM-4.7 для задач кодирования, рассуждения и агентных workflow с низкой задержкой и высокой пропускной способностью. Достигает open source SOTA среди моделей своего класса на бенчмарках SWE-bench Verified и t2-Bench.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 202K токенов |
Максимальная длина вывода | 16K токенов |
Мультимодальность | Текст |
Дата выхода | 19 января 2026 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
SWE-bench Verified | 59.2% |
t2-Bench | 79.5 |
AIME 25 | 91.6 |
GPQA | 75.2 |
LiveCodeBench v6 | 64.0 |
BrowseComp | 42.8 |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 8 руб |
Исходящие (Output) | 44 руб |
Тип кеша | Цена за 1M токенов |
|---|---|
Чтение из кеша (cache hit) | 1 руб |
TTL (Time To Live) - время хранения данных в кеше перед автоматическим удалением.
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: glm-4.7-flash.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4.7-flash",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
X-Api-Key | $DSLAB_API_KEY (альтернатива для Anthropic SDK) |
Content-Type | application/json |
Model | glm-4.7-flash |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
| map | - | Управление режимом рассуждений: {"type":"enabled","budget_tokens":N} |
| array | - | Список доступных инструментов и их параметров (формат OpenAI) |
| map | - | Задает требуемый формат ответа модели (например, JSON) |
| array | - | Останавливает генерацию при появлении указанных стоп-последовательностей токенов |



