O GLM-5 é o modelo de base open source principal da Z.ai, projetado para o design de sistemas complexos e fluxos de trabalho de agentes de longo prazo. Voltado a desenvolvedores experientes, entrega desempenho de nível de produção em tarefas de programação de larga escala e combina planejamento agêntico avançado, raciocínio profundo de backend e autocorreção iterativa, indo além da geração de código para a construção de sistemas completos e a execução autônoma. Ele oferece raciocínio, chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. Disponível pelos protocolos OpenAI e Anthropic na Ofox.
Providers
/v1/chat/completions/v1/chat/completionsExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilidade e status
Benchmarks
Z.ai: GLM-5 obtém 1456 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 44º de 374 modelos com base em 27.815 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1456 | 1452–1461 | 44º de 374 | 27.815 |
| Prompts difíceis | 1478 | 1472–1483 | 44º de 374 | 17.145 |
| Programação | 1498 | 1490–1505 | 54º de 369 | 7.214 |
| Matemática | 1443 | 1428–1457 | 56º de 362 | 1.607 |
| Escrita criativa | 1445 | 1435–1454 | 32º de 372 | 4.518 |
| Seguimento de instruções | 1446 | 1440–1453 | 46º de 374 | 8.912 |
| Chinês | 1523 | 1507–1539 | 14º de 344 | 1.511 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.