Логотип Data Secrets
LAB

Fugu Ultra v1.1

Последняя модель для кодинга от Sakana AI

LLM

Содержание

О модели#

Fugu-Ultra v1.1 - обновленная версия оркестратора Sakana AI: под каждую задачу она координирует пул экспертных агентов и маршрутизирует запрос между одним и тремя из них в зависимости от сложности. По сравнению с v1.0 в пул добавлены более свежие frontier-модели, что дало прирост до 7,9 пункта на отслеживаемых бенчмарках при той же цене. Модель совместима с OpenAI Chat Completions, поддерживает вызов инструментов, структурированный вывод и стриминг.

Данные и конфиденциальность#

Официальный провайдер модели - Sakana AI. Запросы к Fugu-Ultra v1.1 обрабатываются на его стороне, и в рамках оркестрации ввод может передаваться во внешние LLM-провайдеры и облачную инфраструктуру, которых использует Sakana.

По условиям Sakana провайдер может использовать передаваемый контент для обучения, оценки и улучшения моделей, возможна обработка запросов ревьюерами. Отказ (opt-out) доступен, но не имеет обратной силы.

Условия Sakana запрещают вводить персональные данные, чувствительную медицинскую и финансовую информацию, коммерческие тайны и чужие конфиденциальные данные без прав. Не отправляйте секретные и чувствительные данные без отдельного корпоративного соглашения.

Формат вывода и токены оркестрации#

Модель отвечает в OpenAI-совместимом формате Chat Completions. Поддерживается структурированный вывод через response_format: обычный текст, json_object и json_schema. В нашем сервисе доступен Chat Completions.

Fugu-Ultra v1.1 - оркестратор: под задачу он задействует от одного до трех экспертных агентов. Помимо обычных входных и выходных токенов учитываются токены оркестрации - расход на координацию агентов вне видимого ввода и вывода. Они возвращаются в полях prompt_tokens_details.orchestration_input_tokens и completion_tokens_details.orchestration_output_tokens, тарифицируются по обычным ставкам input и output и учитываются в итоговой стоимости запроса.

Параметр max_completion_tokens ограничивает только финальный ответ, у оркестратора свой лимит на координацию агентов.

Характеристики#

Параметр

Значение

Контекстное окно

1M токенов

Максимальная длина вывода

128K токенов

Мультимодальность

Текст

Дата выхода

24 июля 2026

Бенчмарки#

Бенчмарк

Результат

ProgramBench

79.8%

Terminal Bench 2.1

90.0%

GPQA-D

95.6%

Humanity's Last Exam (text)

53.5%

SWEBench Pro

78.1%

Стоимость#

Тип токенов

Стандарт

Контекст > 272K

Входящие (Input)

500 руб

1 000 руб

Исходящие (Output)

3 000 руб

4 500 руб

Кешированный ввод (Cached input)

50 руб

100 руб

Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽. Цены за 1M токенов; повышенный тариф применяется, когда контекст запроса превышает 272K токенов.

API#

1. Создайте API-ключ на странице dslab.tech/api/keys

2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: fugu-ultra-v1.1.

3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries

Обычный запрос
from openai import OpenAI

client = OpenAI(
    base_url="https://api.dslab.tech/v1",
    api_key="YOUR_DSLAB_API_KEY",
)

response = client.chat.completions.create(
    model="fugu-ultra-v1.1",
    messages=[
        {"role": "user", "content": "Напиши функцию сортировки на Python"}
    ]
)

print(response.choices[0].message.content)

Эндпоинт#

Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.

POST https://api.dslab.tech/v1/chat/completions

Поле

Значение

Authorization

Bearer $DSLAB_API_KEY

Content-Type

application/json

Model

fugu-ultra-v1.1

Параметры#

Параметр

Тип

По умолчанию

Описание

max_completion_tokens

integer

-

Максимум токенов в финальном ответе (у Fugu-Ultra применяется только к итоговому ответу, оркестратор использует свой лимит)

reasoning_effort

string

high

Глубина рассуждений модели: high, xhigh или max (xhigh и max - псевдонимы одного уровня)

tools

array

-

Список доступных инструментов в формате OpenAI

tool_choice

string | object

auto

Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет

response_format

map

-

Структурированный вывод: text, json_object или json_schema

stream

boolean

false

Потоковая передача ответа по мере генерации

Еще модели от этого провайдера

Все