GLM 5.3 Flash через Tokenator API

Назначение модели

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач, связанных с агентами с длительным горизонтом планирования. Ее гибридная архитектура с разреженным и линейным вниманием обеспечивает точное поведение в длительном контексте, одновременно снижая вычислительные затраты.

Спецификация

Полное названиеGLM 5.3 Flash
API IDglm-5.3-flash
Разработчик моделиZ-AI
ТипТекстовая модель (chat / completions)
Контекстное окно1M токенов
Максимальный output131.1K токенов
Изображения на входеда
Множитель расхода Tokenator1.7×
Модальности входаtext, image, video
Алиасыcursor-glm-5.3-flash
Поддерживаемые форматы API/v1/chat/completions /v1/responses /v1/messages
Апстрим-провайдеров1
Текущий статусдоступна
Данные обновлены2026-08-26

Апстрим-провайдеры

ПровайдерМножитель
Unified LLM API1.7×

Запрос идёт к первому доступному провайдеру по приоритету; при его отказе Tokenator переключается на следующего.

Пример запроса

curl
curl https://api.tokenator.top/v1/chat/completions \
  -H "Authorization: Bearer sk-your-tokenator-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

Совместимые инструменты

Модель можно указать в любом инструменте, который принимает произвольный base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code, Cherry Studio, OpenClaw.

Частые вопросы о GLM 5.3 Flash

Какой API ID у GLM 5.3 Flash?

glm-5.3-flash — это значение подставляется в поле model запроса.

Какое контекстное окно у GLM 5.3 Flash?

1M токенов; максимальный output — 131.1K токенов.

Сколько токенов спишется за запрос?

(input + output) × 1.7×. Подробнее о подсчёте — в документации.

В каких инструментах работает эта модель?

В любом, который принимает произвольный base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code. Инструкции — в разделе интеграций.