O GLM-4.7-Flash é o modelo da classe 30B da Z.ai que equilibra desempenho e eficiência. Ele foi otimizado ainda mais para programação com agentes, reforçando a capacidade de codificação, o planejamento de tarefas de longo prazo e a colaboração com ferramentas, e alcança desempenho de liderança entre modelos de código aberto do mesmo tamanho em vários rankings públicos de benchmarks. Ele oferece chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. Esta variante é gratuita: os tokens de entrada e de saída são cobrados a $0. Disponível pelos protocolos OpenAI e Anthropic na Ofox.
Preços
| Tipo | Preço |
|---|---|
| Tokens de Entrada | $0/M |
| Tokens de Saída | $0/M |
| Busca Web | $0.01/R |
Exemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.7-flash:free",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM-4.7-Flash (Free) obtém 1368 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 162º de 374 modelos com base em 11.720 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1368 | 1362–1374 | 162º de 374 | 11.720 |
| Prompts difíceis | 1387 | 1379–1394 | 159º de 374 | 6.515 |
| Programação | 1423 | 1412–1435 | 154º de 369 | 2.686 |
| Matemática | 1366 | 1345–1387 | 162º de 362 | 715 |
| Escrita criativa | 1313 | 1299–1327 | 183º de 372 | 1.809 |
| Seguimento de instruções | 1351 | 1341–1361 | 167º de 374 | 3.171 |
| Chinês | 1434 | 1406–1461 | 120º de 344 | 442 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.