LLM

GPT-6 Astra
Флагманская модель OpenAI для сложной агентной работы

Muse Spark 1.3
Мультимодальная reasoning-модель Meta для длительных задач

Gemini 3.8 Flash
Быстрая мультимодальная модель Google для агентных задач

Claude Fable 5.1
Улучшенная модель Anthropic для долгих агентных задач

GLM 5.3 Flash
Мультимодальная модель Z.ai для эффективного кодинга

GLM 5.3
Флагманская модель Z.ai для сложной разработки

Gemini 3.7 Flash
Быстрая мультимодальная модель Google для сложных задач

DeepSeek V4 Pro 0813
Обновленная reasoning-модель DeepSeek для сложных задач

Grok 4.6
Флагманская reasoning-модель xAI для сложных задач

Sakana Namazu
Японская reasoning-модель Sakana AI для сложных задач

Qwen3.8 Max
Флагманская мультимодальная модель Alibaba Cloud

DeepSeek V4 Flash 0731
Официальный релиз DeepSeek V4 Flash для агентных задач

Fugu Ultra v1.1
Обновленный оркестратор экспертных агентов Sakana AI

Claude Opus 5
Флагманская модель Anthropic для сложных задач

Gemini 3.5 Flash-Lite
Самая быстрая и экономичная модель Google в линейке 3.5

Gemini 3.6 Flash
Быстрая мультимодальная модель Google с ризонингом

Kimi K3
Флагманская модель Moonshot AI с ризонингом и 1M контекстом

Inkling 256K
Inkling с расширенным контекстом 256K токенов

Inkling
Open-weights мультимодальная модель Thinking Machines

KAT-Coder-Pro V2.5
Агентная coding-модель KwaiKAT для репозиториев

Grok 4.5
Быстрая флагманская модель xAI для кода и агентов

Hy3
Мощная reasoning-модель Tencent для агентных задач

Claude Sonnet 5
Быстрая модель Anthropic для кода и агентов

GPT-5.6 Luna
Быстрая и доступная модель OpenAI

GPT-5.6 Terra
Сбалансированная модель OpenAI для повседневных задач

GPT-5.6 Sol
Флагманская модель OpenAI для сложных задач
НовоеGLM-5.2
Флагман Zhipu AI с контекстом 1M токенов
НовоеFugu Ultra
Оркестратор экспертных агентов Sakana AI

Claude Fable 5
Флагманская модель Anthropic для долгих агентных задач

Qwen3.6 Max Preview
Превью-версия старшей модели Alibaba Cloud серии Qwen3.6

Qwen3.7 Max
Флагманская модель Alibaba Cloud серии Qwen3.7

Qwen3.7 Plus
Доступная мультимодальная модель Qwen с ризонингом

MiniMax M3
Мультимодальная модель MiniMax с длинным контекстом, reasoning и tools.

Step 3.7 Flash
Мультимодальная reasoning-модель StepFun для агентных задач
НовоеClaude Opus 4.8
Мощная модель Anthropic для сложных задач

Grok 4.3
Флагманская модель xAI с мощными агентными возможностями

GPT-5.5
Флагманская модель OpenAI для агентных задач

DeepSeek V4 Pro
DeepSeek V4 Pro - флагманская модель с 1.6T параметрами (49B активируется) и контекстным окном 1M токенов. В режиме max занимает первое место среди open-source моделей: LiveCodeBench 93.5%, Codeforces Rating 3206, SWE Verified 80.6%. Поддерживает три режима reasoning (non-think, high, max). Hybrid Attention архитектура требует только 10% KV cache от DeepSeek-V3 при 1M контексте. Обучена на 32T+ токенов.

DeepSeek V4 Flash
DeepSeek V4 Flash - легкая модель из серии V4 с 284B параметрами (13B активируется) и контекстным окном 1M токенов. Поддерживает три режима: non-think (быстрый ответ), think high (стандартный reasoning) и think max (максимальная глубина рассуждений). В режиме max достигает результатов, сопоставимых с V4-Pro: LiveCodeBench 91.6%, SWE Verified 79.0%. Новая Hybrid Attention архитектура с Compressed Sparse Attention обеспечивает эффективную работу с длинным контекстом.

Kimi K2.6
Флагманская модель Moonshot AI для сложного программирования и агентных задач

Claude Opus 4.7
Claude Opus 4.7 - мощное обновление Opus с Adaptive Thinking и значительно улучшенным зрением (изображения до 3.75 МП). Лидер в агентном программировании, computer use и финансовом анализе. Использует новый токенизатор и поддерживает уровень xhigh параметра effort - точка между high и max для тонкой настройки глубины рассуждений.

GLM 5.1
Модель Z.ai для длительных автономных задач

GLM-5V Turbo
Мультимодальная vision-модель Z.ai для кода и agentic-задач

MiniMax M2.7
Самоэволюционирующая агентная модель MiniMax для сложных инженерных задач

GPT-5.4 nano
Самая компактная и быстрая модель семейства GPT-5.4

GPT-5.4 mini
Быстрая и эффективная версия GPT-5.4 для высоконагруженных задач

GLM-5 Turbo
Модель Z.ai под агентные задачи и работу с инструментами

GPT-5.4 Pro
Максимально мощная версия GPT-5.4 для сложных задач

GPT-5.4
Флагманская модель OpenAI с reasoning и computer use

GPT-5.3 chat
Флагманская чат-модель OpenAI для повседневных задач

Qwen3.5-35B-A3B
Reasoning MoE с 3B активными параметрами из Qwen3.5

Qwen3.5-122B-A10B
Флагманская Qwen3.5 MoE с продвинутым рассуждением

Qwen3.5-27B
Reasoning-модель Qwen нового поколения

Gemini 3.1 Pro
Gemini 3.1 Pro - флагманская модель Google нового поколения с расширенным контекстным окном до 1M токенов. Лучший выбор для сложных аналитических, исследовательских и мультимодальных задач. Цены зависят от объема контекста: запросы до 200K токенов тарифицируются по стандартным ставкам, свыше 200K - по повышенным.

Claude Sonnet 4.6
Claude Sonnet 4.6 - самая производительная модель Sonnet от Anthropic. Поддерживает Extended и Adaptive Thinking. Значительный прогресс в программировании, computer use и работе с длинным контекстом. Достигает производительности уровня Opus 4.5 при стоимости Sonnet. Контекстное окно 1M токенов в бета-режиме.

Qwen3.5-Plus
Гибридный флагман Qwen с 1M токенами контекста

Qwen3.5-397B-A17B
Флагманская reasoning MoE-модель Qwen3.5

MiniMax M2.5
Флагманская модель MiniMax для программирования и агентных задач

GLM-5
Флагман Z.ai для агентной инженерии и кодинга

GPT-5.3 codex
Агентная модель OpenAI для сложных задач программирования

Claude Opus 4.6
Claude Opus 4.6 - обновление самой умной модели Anthropic с поддержкой Extended Thinking и Adaptive Thinking. Первая модель класса Opus с контекстным окном до 1M токенов (бета). Лидирует по агентному программированию, computer use, инструментальному поиску и финансовому анализу. Поддерживает управление усилием через параметр effort (low/medium/high/max).

Qwen3-Coder-Next
Передовая кодерная MoE-модель нового поколения

Kimi K2.5
Открытая модель Moonshot AI для агентных задач и программирования

GLM-4.7 Flash
Легкая быстрая MoE-модель Z.ai для кода и агентных задач

GPT-5.2 codex
Специализированная модель OpenAI для агентного кодирования

MiniMax M2.1
Модель MiniMax для многоязычного программирования и агентных задач

GLM-4.7
Модель Z.ai для многошаговой разработки с инструментами

Gemini 3 Flash
Gemini 3 Flash - быстрая мультимодальная модель нового поколения Google. Улучшенное качество относительно Gemini 2.5 Flash при сохранении высокой скорости. Поддерживает контекст 1M токенов, работу с текстом, изображениями и видео.

GPT-5.2 chat
Быстрая chat-версия GPT-5.2 для диалоговых задач

GPT-5.2
Флагманская модель OpenAI нового поколения

GPT-5.1 codex
Специализированная модель OpenAI для кода и агентных задач

GPT-5.1 chat
GPT-5.1 Instant - быстрая чат-версия с высоким интеллектом

GPT-5.1
Флагманская модель OpenAI с адаптивным рассуждением

Claude Opus 4.5
Claude Opus 4.5 - мощная модель Anthropic с поддержкой Extended Thinking для глубокого анализа и рассуждений. Лидер среди агентных задач: программирование, computer use и многошаговые рабочие процессы. Значительно лучше предшественников в работе с кодом, инструментами и длительных сессиях.

Claude Haiku 4.5
Claude Haiku 4.5 - самая быстрая модель Anthropic с почти фронтирным интеллектом. Дает производительность, сопоставимую с Sonnet 4, но в 3 раза дешевле и более чем в 2 раза быстрее. Идеально подходит для задач в реальном времени: чат-ассистенты, агенты поддержки, парное программирование и мультиагентные сценарии.

GPT-5 codex
GPT-5, оптимизированный для агентного программирования

Qwen3-Next-80B-Thinking
Qwen3-Next MoE с режимом рассуждений для сложных задач

Qwen3-Next-80B-Instruct
Быстрая Qwen3-Next MoE модель для текстовых задач

DeepSeek V3.1
DeepSeek V3.1 - гибридная модель с поддержкой thinking и non-thinking режима в рамках одной модели. В non-thinking режиме превосходит V3-0324 по всем ключевым бенчмаркам (MMLU-Pro: 83.7%, GPQA Diamond: 74.9%). В thinking режиме показывает результаты, сопоставимые с R1-0528: AIME 2024 93.1%, LiveCodeBench 74.8%. Значительно улучшены агентные возможности: SWE Verified Agent 66.0%, SWE Multilingual 54.5%. MoE-архитектура: 671B параметров, 37B активируется при инференсе.

GPT-5 nano
Самая быстрая и дешевая модель семейства GPT-5

GPT-5 mini
Компактная версия GPT-5 с балансом качества и стоимости

GPT-5 chat
Диалоговый вариант GPT-5 без встроенного ризонинга

GPT-5
Флагманская модель OpenAI нового поколения

GPT-OSS 20B
Компактная open-weight reasoning модель OpenAI (Apache 2.0), 21B параметров

GPT-OSS 120B
Open-weight reasoning модель OpenAI (Apache 2.0), 117B параметров

GLM-4.5
Открытая агентная MoE-модель Z.ai для кода и рассуждений

Qwen3 235B A22B Thinking 2507
Специализированная reasoning-версия Qwen3-235B с глубоким рассуждением

Qwen3-Coder-480B
Флагманская кодерная MoE-модель Alibaba Cloud

Gemini 2.5 Flash Lite
Gemini 2.5 Flash Lite - самая быстрая и доступная по цене модель в семействе Gemini 2.5. Идеальна для задач с высоким трафиком, где критична скорость отклика. Поддерживает контекст 1M токенов, работу с изображениями и видео.

Qwen3 235B A22B Instruct 2507
Обновленная быстрая инструкт-версия Qwen3-235B без рассуждений

Gemini 2.5 Flash
Gemini 2.5 Flash - быстрая и эффективная модель Google с поддержкой расширенного контекста до 1M токенов. Оптимальный баланс скорости и качества для задач с длинными документами, изображениями и видео. Поддерживает Extended Thinking для глубокого анализа сложных задач.

DeepSeek R1 0528
DeepSeek R1 0528 - обновленная версия флагманской reasoning-модели DeepSeek. Значительно улучшена глубина рассуждений за счет увеличенного compute и алгоритмических оптимизаций в post-training: AIME 2025 вырос с 70% до 87.5%, LiveCodeBench с 63.5% до 73.3%, SWE Verified с 49.2% до 57.6%. Улучшены поддержка function calling и снижен процент галлюцинаций. Цепочка рассуждений всегда доступна через reasoning_content в ответе.

Qwen3-32B
Плотная модель Qwen3 с переключаемым режимом рассуждений

Qwen3-30B-A3B
Эффективная MoE-модель с режимом рассуждений

Qwen3 235B A22B
Гибридная MoE-модель Qwen3 с переключаемым режимом рассуждений

GPT-4.1 nano
Самая быстрая и дешевая модель OpenAI с контекстом 1M токенов

GPT-4.1 mini
Компактная и быстрая модель OpenAI уровня GPT-4o по цене ниже

GPT-4.1
Флагманская модель OpenAI с миллионным контекстом для кода и агентов

Llama 4 Scout
Компактная мультимодальная модель Meta с рекордным контекстом 10M токенов

Llama 4 Maverick
Флагманская мультимодальная модель Meta четвертого поколения

DeepSeek V3 0324
DeepSeek V3 0324 - обновленная версия флагманской нон-рассуждающей модели DeepSeek с улучшенными reasoning-способностями. MMLU-Pro вырос с 75.9 до 81.2, GPQA Diamond с 59.1 до 68.4, AIME с 39.6 до 59.4, LiveCodeBench с 39.2 до 49.2. Улучшены поддержка function calling, генерация frontend-кода и качество текста на китайском языке. MoE-архитектура: 671B параметров, 37B активируется при инференсе.

Qwen2.5-VL 72B
Мультимодальная модель Alibaba Cloud с поддержкой изображений

Llama 3.3 70B
Мощная открытая модель Meta с производительностью уровня 405B

Qwen2.5 7B
Компактная и быстрая модель Qwen2.5 для эффективных задач

Qwen2.5 72B
Мощная модель Alibaba Cloud для широкого круга задач

Llama 3.1 8B
Быстрая и доступная открытая модель Meta для повседневных задач

Mistral NeMo
Мощная 12B модель Mistral AI и NVIDIA для многоязычных задач

GPT-4o mini
Быстрая и доступная модель OpenAI для повседневных задач

GPT-4o
Флагманская мультимодальная модель OpenAI