О модели#
DeepSeek V4 Flash - легкая модель из серии V4 с 284B параметрами (13B активируется) и контекстным окном 1M токенов. Поддерживает три режима: non-think (быстрый ответ), think high (стандартный reasoning) и think max (максимальная глубина рассуждений). В режиме max достигает результатов, сопоставимых с V4-Pro: LiveCodeBench 91.6%, SWE Verified 79.0%. Новая Hybrid Attention архитектура с Compressed Sparse Attention обеспечивает эффективную работу с длинным контекстом.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 1M токенов |
Максимальная длина вывода | 131K токенов |
Мультимодальность | Текст |
Дата выхода | 22 апреля 2026 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
GPQA Diamond (max) | 88.1% |
Humanity's Last Exam (max) | 34.8% |
LiveCodeBench (max) | 91.6% |
Codeforces Rating (max) | 3052 |
HMMT 2026 Feb (max) | 94.8% |
SWE Verified (max) | 79.0% |
SWE Verified (non-think) | 73.7% |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 9 руб |
Исходящие (Output) | 18 руб |
Тип кеша | Цена за 1M токенов |
|---|---|
Чтение из кеша (cache hit) | 2 руб |
TTL (Time To Live) - время хранения данных в кеше перед автоматическим удалением.
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: deepseek-v4-flash.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | deepseek-v4-flash |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
| map | enabled | Включает или выключает thinking-режим. По умолчанию включен. Передавать в extra_body: {"thinking": {"type": "enabled"}} |
| string | high | Глубина рассуждений в thinking-режиме: "high" (по умолчанию) или "max" |
| array | - | Список доступных инструментов и их параметров (формат OpenAI) |
| map | - | Задает требуемый формат ответа модели (например, JSON) |
| array | - | Останавливает генерацию при появлении указанных стоп-последовательностей токенов |



