모든 GPT 20% 할인 🎉 DeepSeek 30% 할인자세히 보기

Z.ai: GLM-5.3-FlashX

Chat-59%
z-ai/glm-5.3-flashx

GLM-5.3-FlashX는 z.ai 국제 사이트(api.z.ai)에서 효율적인 코딩과 장기 Agent 작업을 위해 선보인 경량 고속 모델로, 추론 속도가 최대 200 tokens/s에 달해 더 빠르고 매끄러운 모델 경험을 제공합니다. 네이티브 멀티모달 입력(이미지, 영상), 1M 컨텍스트, 상시 활성화된 thinking(비활성화 불가, low·high·max 3단계 reasoning effort 지원), prompt caching, tool calling, web search를 지원하며, OpenAI-compatible과 Anthropic 두 가지 프로토콜로 연동됩니다(Responses 엔드포인트는 지원하지 않습니다).

컨텍스트 윈도우
1M
최대 출력 토큰
131K
출시일
2026-08-26
기능
비전Function Calling추론프롬프트 캐싱웹 검색영상 입력
제공업체
Z.ai
지원 프로토콜
openaianthropic

Providers

Z.aiprovider.type: "zai"
-59%
입력 토큰
$0.15/M
$0.37/M
출력 토큰
$0.5/M
$1.25/M
캐시 읽기
$0.03/M
$0.075/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

코드 예제

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3-flashx",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

자주 묻는 질문

Z.ai: GLM-5.3-FlashX은(는) Ofox.ai에서 입력 $0.37/M/백만 토큰, 출력 $1.25/M/백만 토큰입니다. 종량제, 월정액 없음.