О модели#
Llama 4 Maverick - мощная мультимодальная модель Meta на архитектуре Mixture-of-Experts с 17B активными параметрами из 400B общих. Поддерживает анализ изображений, длинные контексты до 1M токенов и превосходит GPT-4o на широком наборе задач. Модель четвертого поколения с нативной мультимодальностью и улучшенным следованием инструкциям.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 1M токенов |
Максимальная длина вывода | 16K токенов |
Мультимодальность | Текст, изображения |
Дата выхода | 5 апреля 2025 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
MMLU | 92.2% |
MMLU-Pro | 80.5% |
GPQA Diamond | 69.8% |
LiveCodeBench | 43.4% |
MMMU (vision) | 73.4% |
DocVQA | 94.4% |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 17 руб |
Исходящие (Output) | 66 руб |
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: llama-4-maverick.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-4-maverick",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | llama-4-maverick |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
| array | - | Список доступных инструментов и их параметров (формат OpenAI) |
| map | - | Задает требуемый формат ответа модели (например, JSON) |
| array | - | Останавливает генерацию при появлении указанных стоп-последовательностей токенов |



