20% на все GPT 🎉 30% на DeepSeekПодробнее

Z.ai: GLM-5.3-FlashX

Chat-59%
z-ai/glm-5.3-flashx

GLM-5.3-FlashX — это лёгкая высокоскоростная модель z.ai на международном сайте (api.z.ai), созданная для эффективного программирования и длительных Agent-задач: скорость вывода достигает 200 tokens/s, обеспечивая более быструю и плавную работу с моделью. Поддерживает нативный мультимодальный ввод (изображения, видео), контекст 1M, постоянный thinking (не отключается, доступны три уровня reasoning effort: low, high, max), prompt caching, tool calling и web search, а также подключается по двум протоколам — OpenAI-compatible и Anthropic (конечная точка Responses не поддерживается).

Контекстное окно
1M
Макс. выходных токенов
131K
Дата релиза
2026-08-26
Возможности
ЗрениеFunction CallingРассуждениеКэширование промптовВеб-поискВидео-вход
Доступные провайдеры
Z.ai
Поддерживаемые протоколы
openaianthropic

Providers

Z.aiprovider.type: "zai"
-59%
Входные токены
$0.15/M
$0.37/M
Выходные токены
$0.5/M
$1.25/M
Чтение кэша
$0.03/M
$0.075/M
Веб-поиск
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Примеры кода

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3-flashx",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Часто задаваемые вопросы

Z.ai: GLM-5.3-FlashX на Ofox.ai стоит $0.37/M за миллион входных токенов и $1.25/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.