O GLM-5-Turbo é um modelo de base da Z.ai profundamente otimizado para o cenário OpenClaw. Ele foi ajustado desde a fase de treinamento para os requisitos centrais das tarefas do OpenClaw, reforçando capacidades essenciais como invocação de ferramentas, obediência a comandos, tarefas agendadas e persistentes e execução de cadeias longas. Ele oferece raciocínio, chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. Disponível pelos protocolos OpenAI e Anthropic.
Janela de Contexto
200K
Tokens Máx de Saída
128K
Lançamento
2026-03-16
Capacidades
Function CallingRaciocínioPrompt CachingBusca Web
Provedores Disponíveis
Zhipu
Protocolos Suportados
openaianthropic
Providers
Zhipu
Tokens de Entrada
$1.2/M
Tokens de Saída
$4/M
Leitura de Cache
$0.24/M
Busca Web
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Exemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5-turbo",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modelos Relacionados
Perguntas Frequentes
Z.ai: GLM-5-Turbo na Ofox.ai custa $1.2/M por milhão de tokens de entrada e $4/M por milhão de tokens de saída. Pague por uso, sem mensalidade.
Z.ai: GLM-5-Turbo suporta uma janela de contexto de 200K tokens com saída máxima de 128K tokens, permitindo processar documentos grandes e manter conversas longas.
Basta definir sua base URL como https://api.ofox.ai/v1 e usar sua API key Ofox. A API é compatível com OpenAI — apenas mude a base URL e a API key no seu código existente.
Z.ai: GLM-5-Turbo suporta as seguintes capacidades: Function Calling, Raciocínio, Prompt Caching, Busca Web. Acesse todos os recursos pela API unificada Ofox.ai.