Z.ai: GLM-5.3-Flash
Chat-50%z-ai/glm-5.3-flashGLM-5.3-Flash 是 z.ai 国际站 (api.z.ai) 轻量高速模型, 原生多模态输入 (图片/视频), 面向高效编码与长程 agent 任务. 1M context, 常驻 thinking (不可关闭, 支持 low/high/max 三档 reasoning effort), 支持 prompt caching / tool calling / web search. 通过 OpenAI-compatible + Anthropic 双协议接入 (无 responses 端点).
Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-26
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
Z.ai
Unterstützte Protokolle
openaianthropic
Providers
Z.ai
-50%Eingabe-Tokens
$0.075/M
$0.15/M
Ausgabe-Tokens
$0.25/M
$0.5/M
Cache-Lesen
$0.015/M
$0.03/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5.3-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verfügbarkeit & Status
Verwandte Modelle
Häufig gestellte Fragen
Z.ai: GLM-5.3-Flash auf Ofox.ai kostet $0.15/M pro Million Eingabe-Tokens und $0.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.
Z.ai: GLM-5.3-Flash unterstützt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 131K Tokens, was die Verarbeitung großer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.ai/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.
Z.ai: GLM-5.3-Flash unterstützt folgende Fähigkeiten: Vision, Function Calling, Reasoning, Prompt Caching, Websuche, Video-Eingabe. Zugriff auf alle Features über die einheitliche Ofox.ai API.