Логотип Data Secrets
LAB

Gemini 2.5 Flash Lite

Последняя модель для кодинга от Google

LLM

Содержание

О модели#

Gemini 2.5 Flash Lite - самая быстрая и доступная по цене модель в семействе Gemini 2.5. Идеальна для задач с высоким трафиком, где критична скорость отклика. Поддерживает контекст 1M токенов, работу с изображениями и видео.

Характеристики#

Параметр

Значение

Контекстное окно

1M токенов

Максимальная длина вывода

65K токенов

Мультимодальность

Текст, изображения, видео

Дата выхода

2025

Стоимость#

Тип токенов

Цена за 1M токенов

Входящие (Input)

11 руб

Исходящие (Output)

44 руб

Тип кеша

Цена за 1M токенов

Запись в кеш (5 мин TTL)

9 руб

Запись в кеш (1 ч TTL)

110 руб

Чтение из кеша (cache hit)

1 руб

TTL (Time To Live) - время хранения данных в кеше перед автоматическим удалением.

Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.

API#

1. Создайте API-ключ на странице dslab.tech/api/keys

2. Используйте https://api.dslab.tech/v1 как base_url в любом OpenAI-совместимом SDK. Модель: gemini-2.5-flash-lite.

3. Ознакомьтесь с документацией SDK: platform.openai.com/docs/libraries

Обычный запрос
curl https://api.dslab.tech/v1/chat/completions \
  -H "Authorization: Bearer YOUR_DSLAB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2.5-flash-lite",
    "messages": [
      {"role": "user", "content": "Напиши функцию сортировки на Python"}
    ]
  }' 

Эндпоинт#

Отправляет запрос на получение ответа модели для заданного диалога. Поддерживает потоковый и обычный режим.

POST https://api.dslab.tech/v1/chat/completions

Поле

Значение

Authorization

Bearer $DSLAB_API_KEY

Content-Type

application/json

Model

gemini-2.5-flash-lite

Параметры#

Параметр

Тип

По умолчанию

Описание

max_tokens

integer

-

Максимальное количество токенов в ответе

tools

array

-

Список доступных инструментов и их параметров (формат OpenAI)

tool_choice

string | object

auto

Управляет использованием инструментов: автоматический выбор, принудительный вызов или запрет

response_format

map

-

Задает требуемый формат ответа модели (например, JSON)

stop

array

-

Останавливает генерацию при появлении указанных стоп-последовательностей токенов

Еще модели от этого провайдера

Все