Qwen: Qwen3.8 Flash
Chatbailian/qwen3.8-flash阿里云百炼 Qwen3.8 系列 Flash 轻量高速原生多模态模型, 1M context, 支持图像/视频理解与深度推理 (reasoning_content, 可按请求开关), 面向高并发低成本场景, 兼顾编程与办公任务. 通过 DashScope OpenAI-compatible 端点提供.
Fenêtre de contexte
1M
Tokens de sortie max
131K
Publié
2026-08-25
Capacités
VisionFunction CallingRaisonnementPrompt CachingRecherche webEntrée vidéo
Fournisseurs disponibles
Aliyun
Protocoles supportés
openaianthropic
Providers
Aliyun
Tokens d'entrée
$0.15/M
Tokens de sortie
$0.47/M
Lecture cache
$0.016/M
Écriture cache
$0.2/M
Recherche web
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Exemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.8-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilité et état
Modèles associés
Questions fréquentes
Qwen: Qwen3.8 Flash sur Ofox.ai coûte $0.15/M par million de tokens d'entrée et $0.47/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.
Qwen: Qwen3.8 Flash supporte une fenêtre de contexte de 1M tokens avec un maximum de 131K tokens en sortie, permettant de traiter de longs documents et de maintenir des conversations prolongées.
Configurez simplement votre URL de base sur https://api.ofox.ai/v1 et utilisez votre clé API Ofox. L'API est compatible OpenAI — changez simplement l'URL de base et la clé API dans votre code existant.
Qwen: Qwen3.8 Flash supporte les capacités suivantes : Vision, Function Calling, Raisonnement, Prompt Caching, Recherche web, Entrée vidéo. Accédez à toutes les fonctionnalités via l'API unifiée Ofox.ai.