О модели#
DeepSeek-V4-Flash-0731 - официальный публичный релиз V4 Flash, заменивший превью-версию. Архитектура и размер модели те же, что у V4-Flash-Preview: изменилось только пост-обучение, которое заметно усилило агентные способности. Модель работает с контекстом 1M токенов, выдает до 384K токенов за ответ и по умолчанию отвечает в режиме рассуждений с управляемой глубиной. Нативно поддерживает Responses API и адаптирована под Codex.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 1M токенов |
Максимальная длина вывода | 384K токенов |
Мультимодальность | Текст |
Дата выхода | 31 июля 2026 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
Terminal Bench 2.1 | 82.7 |
NL2Repo | 54.2 |
Cybergym | 76.7 |
DeepSWE | 54.4 |
Toolathlon verified | 70.3 |
Agent Last Exam | 25.2 |
Automation Bench (Public) | 25.1 |
DSBench-FullStack | 68.7 |
DSBench-Hard | 59.6 |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 14 руб |
Исходящие (Output) | 28 руб |
Тип кеша | Цена за 1M токенов |
|---|---|
Запись в кеш | 14 руб |
Чтение из кеша (cache hit) | 0.28 руб |
Дополнительно | Цена |
|---|---|
Поиск в интернете (web_search) | 0.5 руб за запрос |
Токены рассуждений тарифицируются по ставке исходящих токенов.
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: deepseek-v4-flash-0731.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | deepseek-v4-flash-0731 |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| string | high | Глубина рассуждений: low, high или max |
| array | - | Список доступных инструментов и их параметров (до 128 функций) |
| string | object | auto | Управляет использованием инструментов: none, auto, required или конкретная функция |
| map | text | Задает формат ответа: text или json_object |
| string | array | - | До 16 стоп-последовательностей, при появлении которых генерация прерывается |
| boolean | false | Включает потоковую передачу ответа через server-sent events |
| map | - | Опции стриминга, например include_usage для итоговой статистики токенов |
| boolean | false | Возвращает логарифмы вероятностей выданных токенов |
| integer | - | Число наиболее вероятных токенов на позицию (0-20), требует logprobs |
| string | - | Пользовательский идентификатор для изоляции KV-кеша и контроля нагрузки |
Режим рассуждений включен по умолчанию, глубина по умолчанию high. Цепочка рассуждений приходит в поле reasoning_content рядом с content. В режиме рассуждений параметры temperature, top_p, presence_penalty и frequency_penalty не действуют.
Если запрос содержит tools, поле reasoning_content нужно возвращать модели во всех последующих запросах диалога, иначе API ответит ошибкой 400.



