Логотип Data Secrets
LAB

Kimi K2.5

Последняя модель для кодинга от Moonshot AI

Содержание

О модели#

Kimi K2.5 - флагманская открытая модель Moonshot AI нового поколения, обученная методом Full-Parameter RL на смешанных текстовых данных. Модель обеспечивает лидирующие среди открытых моделей показатели на кодинг- и агент-бенчмарках, поддерживает расширенное мышление и агентный режим с роем до 100 параллельных субагентов с выполнением до 1500 вызовов инструментов параллельно. Оптимальная основа для задач разработки, автоматизации и сложных многошаговых агентных сценариев.

Характеристики#

Параметр

Значение

Контекстное окно

262K токенов

Максимальная длина вывода

262K токенов

Мультимодальность

Текст

Дата выхода

27 января 2026

Бенчмарки#

Бенчмарк

Результат

SWE-Bench Verified

76.8%

GPQA Diamond

87.6%

Стоимость#

Тип токенов

Цена за 1M токенов

Входящие (Input)

66 руб

Исходящие (Output)

330 руб

Тип кеша

Цена за 1M токенов

Чтение из кеша (cache hit)

11 руб

TTL (Time To Live) - время хранения данных в кеше перед автоматическим удалением.

Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.

API#

1. Создайте API-ключ на странице dslab.tech/api/keys

2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: kimi-k2.5.

3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries

Обычный запрос
curl https://api.dslab.tech/v1/chat/completions \
  -H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.5",
    "messages": [
      {"role": "user", "content": "Напиши функцию сортировки на Python"}
    ]
  }' 

Эндпоинт#

Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.

POST https://api.dslab.tech/v1/chat/completions

Поле

Значение

Authorization

Bearer $DSLAB_API_KEY

X-Api-Key

$DSLAB_API_KEY (альтернатива для Anthropic SDK)

Content-Type

application/json

Model

kimi-k2.5

Параметры#

Параметр

Тип

По умолчанию

Описание

max_tokens

integer

-

Максимальное количество токенов в ответе

tool_choice

string | object

auto

Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет

effort

string

auto

Управление глубиной рассуждений модели

thinking

map

-

Расширенное мышление: {"type":"enabled","budget_tokens":N}

reasoning_effort

string

-

Глубина рассуждений: low / medium / high

tools

array

-

Список доступных инструментов и их параметров (формат OpenAI)

response_format

map

-

Задает требуемый формат ответа модели (например, JSON)

stop

array

-

Останавливает генерацию при появлении указанных стоп-последовательностей токенов

Еще модели от этого провайдера

Все