О модели#
Fugu-Ultra v1.1 - обновленная версия оркестратора Sakana AI: под каждую задачу она координирует пул экспертных агентов и маршрутизирует запрос между одним и тремя из них в зависимости от сложности. По сравнению с v1.0 в пул добавлены более свежие frontier-модели, что дало прирост до 7,9 пункта на отслеживаемых бенчмарках при той же цене. Модель совместима с OpenAI Chat Completions, поддерживает вызов инструментов, структурированный вывод и стриминг.
Данные и конфиденциальность#
Официальный провайдер модели - Sakana AI. Запросы к Fugu-Ultra v1.1 обрабатываются на его стороне, и в рамках оркестрации ввод может передаваться во внешние LLM-провайдеры и облачную инфраструктуру, которых использует Sakana.
По условиям Sakana провайдер может использовать передаваемый контент для обучения, оценки и улучшения моделей, возможна обработка запросов ревьюерами. Отказ (opt-out) доступен, но не имеет обратной силы.
Условия Sakana запрещают вводить персональные данные, чувствительную медицинскую и финансовую информацию, коммерческие тайны и чужие конфиденциальные данные без прав. Не отправляйте секретные и чувствительные данные без отдельного корпоративного соглашения.
Формат вывода и токены оркестрации#
Модель отвечает в OpenAI-совместимом формате Chat Completions. Поддерживается структурированный вывод через response_format: обычный текст, json_object и json_schema. В нашем сервисе доступен Chat Completions.
Fugu-Ultra v1.1 - оркестратор: под задачу он задействует от одного до трех экспертных агентов. Помимо обычных входных и выходных токенов учитываются токены оркестрации - расход на координацию агентов вне видимого ввода и вывода. Они возвращаются в полях prompt_tokens_details.orchestration_input_tokens и completion_tokens_details.orchestration_output_tokens, тарифицируются по обычным ставкам input и output и учитываются в итоговой стоимости запроса.
Параметр max_completion_tokens ограничивает только финальный ответ, у оркестратора свой лимит на координацию агентов.
Характеристики#
Параметр | Значение |
|---|---|
Контекстное окно | 1M токенов |
Максимальная длина вывода | 128K токенов |
Мультимодальность | Текст |
Дата выхода | 24 июля 2026 |
Бенчмарки#
Бенчмарк | Результат |
|---|---|
ProgramBench | 79.8% |
Terminal Bench 2.1 | 90.0% |
GPQA-D | 95.6% |
Humanity's Last Exam (text) | 53.5% |
SWEBench Pro | 78.1% |
Стоимость#
Тип токенов | Стандарт | Контекст > 272K |
|---|---|---|
Входящие (Input) | 500 руб | 1 000 руб |
Исходящие (Output) | 3 000 руб | 4 500 руб |
Кешированный ввод (Cached input) | 50 руб | 100 руб |
Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽. Цены за 1M токенов; повышенный тариф применяется, когда контекст запроса превышает 272K токенов.
API#
1. Создайте API-ключ на странице dslab.tech/api/keys
2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: fugu-ultra-v1.1.
3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries
from openai import OpenAI
client = OpenAI(
base_url="https://api.dslab.tech/v1",
api_key="YOUR_DSLAB_API_KEY",
)
response = client.chat.completions.create(
model="fugu-ultra-v1.1",
messages=[
{"role": "user", "content": "Напиши функцию сортировки на Python"}
]
)
print(response.choices[0].message.content)Эндпоинт#
Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.
POST https://api.dslab.tech/v1/chat/completions
Поле | Значение |
|---|---|
Authorization | Bearer $DSLAB_API_KEY |
Content-Type | application/json |
Model | fugu-ultra-v1.1 |
Параметры#
Параметр | Тип | По умолчанию | Описание |
|---|---|---|---|
max_completion_tokens | integer | - | Максимум токенов в финальном ответе (у Fugu-Ultra применяется только к итоговому ответу, оркестратор использует свой лимит) |
reasoning_effort | string | high | Глубина рассуждений модели: high, xhigh или max (xhigh и max - псевдонимы одного уровня) |
tools | array | - | Список доступных инструментов в формате OpenAI |
tool_choice | string | object | auto | Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет |
response_format | map | - | Структурированный вывод: text, json_object или json_schema |
stream | boolean | false | Потоковая передача ответа по мере генерации |


