GLM-5는 복잡한 시스템 설계와 장기 에이전트 워크플로를 위해 설계된 Z.ai의 플래그십 오픈소스 파운데이션 모델입니다. 숙련된 개발자를 위해 만들어져 대규모 프로그래밍 작업에서 프로덕션 수준의 성능을 제공하며, 고급 에이전트 계획, 깊은 백엔드 추론, 반복적 자기 수정을 결합해 단순한 코드 생성을 넘어 전체 시스템 구축과 자율 실행까지 수행합니다. 추론, 함수 호출(툴 사용), 프롬프트 캐싱, 웹 검색을 지원합니다. 컨텍스트 윈도우는 200K 토큰, 출력은 128K입니다. Ofox에서 OpenAI 및 Anthropic 프로토콜을 통해 사용할 수 있습니다.
컨텍스트 윈도우
200K
최대 출력 토큰
128K
출시일
2026-02-11
기능
Function Calling추론프롬프트 캐싱웹 검색
제공업체
AliyunZhipu
지원 프로토콜
openaianthropic
Providers
Aliyun
입력 토큰
$1/M
출력 토큰
$3.2/M
캐시 읽기
$0.2/M
웹 검색
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Zhipu
입력 토큰
$1/M
출력 토큰
$3.2/M
캐시 읽기
$0.2/M
웹 검색
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
코드 예제
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
가동 시간 및 상태
벤치마크
LMArena ↗평가 항목: glm-5
Z.ai: GLM-5은(는) LMArena 텍스트 리더보드(스타일 컨트롤) 종합 카테고리에서 1456점을 기록했으며, 27,815건의 인간 선호 투표를 기반으로 374개 모델 중 44위입니다(업데이트: 2026-07-12).
| 카테고리 | Arena 점수 | 95% 신뢰구간 | 순위 | 투표 수 |
|---|---|---|---|---|
| 종합 | 1456 | 1452–1461 | 374개 중 44위 | 27,815 |
| 고난도 프롬프트 | 1478 | 1472–1483 | 374개 중 44위 | 17,145 |
| 코딩 | 1498 | 1490–1505 | 369개 중 54위 | 7,214 |
| 수학 | 1443 | 1428–1457 | 362개 중 56위 | 1,607 |
| 창작 | 1445 | 1435–1454 | 372개 중 32위 | 4,518 |
| 지시 이행 | 1446 | 1440–1453 | 374개 중 46위 | 8,912 |
| 중국어 | 1523 | 1507–1539 | 344개 중 14위 | 1,511 |
출처: LMArena · CC BY 4.0 · 업데이트 2026-07-12 · 평가 방법 ↗ · 순위는 LMArena 텍스트 리더보드(스타일 컨트롤)의 각 카테고리 내 비교이며, 점수는 제3자의 인간 선호 평가로 OFOX 공식 평가가 아닙니다.
관련 모델
자주 묻는 질문
Z.ai: GLM-5은(는) Ofox.ai에서 입력 $1/M/백만 토큰, 출력 $3.2/M/백만 토큰입니다. 종량제, 월정액 없음.
Z.ai: GLM-5은(는) 200K 토큰의 컨텍스트 윈도우와 최대 128K 토큰 출력을 지원하여, 대용량 문서 처리와 장기 대화가 가능합니다.
base URL을 https://api.ofox.ai/v1로 설정하고 Ofox API Key를 사용하면 됩니다. OpenAI 호환 API — 기존 코드에서 base URL과 API Key만 변경하면 됩니다.
Z.ai: GLM-5은(는) Function Calling, 추론, 프롬프트 캐싱, 웹 검색 기능을 지원합니다. Ofox.ai 통합 API로 모든 기능에 접근하세요.