О модели#
Llama 4 Scout - эффективная мультимодальная модель Meta с архитектурой Mixture-of-Experts на 17B активных параметрах из 109B общих. Уникальная особенность - контекстное окно до 10 миллионов токенов, что делает её идеальной для работы с большими документами и длинными диалогами. Поддерживает анализ изображений и превосходит Gemma 3 и Gemini 2.0 Flash-Lite на широком наборе задач.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 10M токенов |
Максимальная длина вывода | 16K токенов |
Мультимодальность | Текст, изображения |
Дата выхода | 5 апреля 2025 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
MMLU-Pro | 74.3% |
GPQA Diamond | 57.2% |
LiveCodeBench | 32.8% |
MMMU (vision) | 73.4% |
MathVista | 73.7% |
DocVQA | 94.4% |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 11 руб |
Исходящие (Output) | 33 руб |
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: llama-4-scout.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-4-scout",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | llama-4-scout |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
| array | - | Список доступных инструментов и их параметров (формат OpenAI) |
| map | - | Задает требуемый формат ответа модели (например, JSON) |
| array | - | Останавливает генерацию при появлении указанных стоп-последовательностей токенов |



