Логотип Data Secrets
LAB

GLM 5.3 Flash

Последняя модель для кодинга от Zhipu AI

LLM

Содержание

О модели#

GLM-5.3-Flash - мультимодальная модель Z.ai для эффективного кодинга и многошаговых агентных задач. Гибридная архитектура с разреженным и линейным вниманием поддерживает длинный контекст при сниженных вычислительных затратах.

Характеристики#

Параметр

Значение

Контекстное окно

1M токенов

Максимальная длина вывода

128K токенов

Мультимодальность

Вход: текст, изображения, видео; выход: текст

Дата выхода

26 августа 2026

Стоимость#

Тип токенов

Цена за 1M токенов

Входящие (Input)

7,5 руб

Исходящие (Output)

25 руб

Тип кеша

Цена за 1M токенов

Чтение из кеша (cache hit)

1,5 руб

Оплата списывается с баланса DS Lab в DS-коинах. 1 DS-коин = 1 ₽.

API#

1. Создайте API-ключ на странице dslab.tech/api/keys

2. Используйте https://api.dslab.tech/v1 как base_url в OpenAI-совместимом SDK. Модель: glm-5.3-flash.

3. Документация модели: docs.z.ai/guides/vlm/glm-5.3-flash

Обычный запрос
from openai import OpenAI

client = OpenAI(
    base_url="https://api.dslab.tech/v1",
    api_key="YOUR_DSLAB_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[{"role": "user", "content": "Напиши функцию сортировки на Python"}],
)

print(response.choices[0].message.content)

Эндпоинт#

Отправляет запрос через OpenAI Chat Completions API. Поддерживает обычный, потоковый и мультимодальный режимы.

POST https://api.dslab.tech/v1/chat/completions

Поле

Значение

Authorization

Bearer $DSLAB_API_KEY

Content-Type

application/json

Model

glm-5.3-flash

Параметры#

Параметр

Тип

По умолчанию

Описание

max_tokens

integer

-

Максимальное количество токенов в ответе, от 1 до 131072

temperature

number

1

Температура выборки, диапазон от 0 до 1

top_p

number

0.95

Nucleus sampling, диапазон от 0.01 до 1

do_sample

boolean

true

Включает стратегию выборки

stream

boolean

false

Потоковая передача ответа

thinking

object

{"type":"enabled"}

Управляет рассуждениями; для GLM-5.3-Flash type поддерживает только enabled

thinking.clear_thinking

boolean

true

Очищать reasoning_content предыдущих ходов

reasoning_effort

string

max

Глубина рассуждений: low, high или max

tool_stream

boolean

false

Потоковая передача вызовов функций

tools

array

-

Список функций; максимум 128 функций

tool_choice

string

auto

Выбор инструмента: auto

response_format

object

text

Формат ответа: text или json_object, без JSON Schema enforcement

stop

array

-

Стоп-последовательности; поддерживается один элемент

Еще модели от этого провайдера

Все