GLM-5V-Turbo is Z.AI’s first multimodal coding foundation model, built for vision-based coding tasks. It can natively process multimodal inputs such as images, video, and text, while also excelling at long-horizon planning, complex coding, and action execution.
200K fenêtre de contexte
128K tokens de sortie max
Publié: 2026-04-01
Protocoles supportés:openaianthropic
Fournisseurs disponibles:Zhipu
Capacités:VisionFunction CallingRaisonnementPrompt CachingRecherche web
Tarifs
| Type | Prix |
|---|---|
| Tokens d'entrée | $1.2/M |
| Tokens de sortie | $4/M |
| Lecture cache | $0.24/M |
| Recherche web | $0.01/R |
Exemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5v-turbo",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modèles associés
Questions fréquentes
GLM-5V-Turbo sur Ofox.ai coûte $1.2/M par million de tokens d'entrée et $4/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.
GLM-5V-Turbo supporte une fenêtre de contexte de 200K tokens avec un maximum de 128K tokens en sortie, permettant de traiter de longs documents et de maintenir des conversations prolongées.
Configurez simplement votre URL de base sur https://api.ofox.ai/v1 et utilisez votre clé API Ofox. L'API est compatible OpenAI — changez simplement l'URL de base et la clé API dans votre code existant.
GLM-5V-Turbo supporte les capacités suivantes : Vision, Function Calling, Raisonnement, Prompt Caching, Recherche web. Accédez à toutes les fonctionnalités via l'API unifiée Ofox.ai.