О модели#
Qwen2.5-7B - эффективная языковая модель серии Qwen2.5 от Alibaba Cloud с 7 миллиардами параметров. Несмотря на компактный размер, демонстрирует впечатляющую производительность: MATH 75.5%, HumanEval 84.8%. Идеальный выбор для задач, требующих баланса между скоростью и качеством: кодирование, математика, вопросы и ответы, поддержка 29+ языков.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 131K токенов |
Максимальная длина вывода | 32K токенов |
Мультимодальность | Текст |
Дата выхода | 19 сентября 2024 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
MMLU (5-shot) | 74.2% |
MMLU-Pro | 56.3% |
GPQA | 36.4% |
MATH | 75.5% |
GSM8K | 91.6% |
HumanEval | 84.8% |
LiveCodeBench | 28.7% |
Arena-Hard | 52.0% |
Стоимость#
Тип токенов | Цена за 1M токенов |
|---|---|
Входящие (Input) | 4 руб |
Исходящие (Output) | 11 руб |
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: qwen2.5-7b.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
curl https://api.dslab.tech/v1/chat/completions \
-H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen2.5-7b",
"messages": [
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
}' Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | qwen2.5-7b |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
| integer | - | Максимальное количество токенов в ответе |
| number | - | Контролирует случайность ответа: ниже - детерминированнее |
| number | - | Ядерная выборка (nucleus sampling) |
| array | - | Список доступных инструментов и их параметров (формат OpenAI) |
| string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
| map | - | Задает требуемый формат ответа модели (например, JSON) |
| array | - | Останавливает генерацию при появлении указанных стоп-последовательностей токенов |



