Qwen3 Coder Flash
Chatbailian/qwen3-coder-flashQwen3-Coder-Flash ist Alibabas kosteneffizientes Coding-Modell auf Basis der Qwen3-Architektur. Es erbt die agentischen Coding-FĂ€higkeiten von Qwen3-Coder-Plus, unterstĂŒtzt Multi-Turn-Tool-Interaktion und ist fĂŒr Repository-Level-Code-VerstĂ€ndnis mit verbesserter Tool-Call-StabilitĂ€t optimiert. Context Window: 1M tokens, Output: 64K. VerfĂŒgbar ĂŒber OpenAI- und Anthropic-Protocol.
Kontextfenster
1M
Max. Ausgabe-Tokens
64K
Veröffentlicht
2025-08-05
FĂ€higkeiten
Function CallingReasoningPrompt Caching
VerfĂŒgbare Anbieter
Aliyun
UnterstĂŒtzte Protokolle
openaianthropic
Providers
Aliyun
Eingabe-Tokens
$0.5/M
Ausgabe-Tokens
$2.5/M
Cache-Lesen
$0.06/M
Cache-Schreiben
$0.27/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3-coder-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verwandte Modelle
HĂ€ufig gestellte Fragen
Qwen3 Coder Flash auf Ofox.ai kostet $0.5/M pro Million Eingabe-Tokens und $2.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen GebĂŒhren.
Qwen3 Coder Flash unterstĂŒtzt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 64K Tokens, was die Verarbeitung groĂer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.ai/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel â einfach Base-URL und API Key in Ihrem bestehenden Code Ă€ndern.
Qwen3 Coder Flash unterstĂŒtzt folgende FĂ€higkeiten: Function Calling, Reasoning, Prompt Caching. Zugriff auf alle Features ĂŒber die einheitliche Ofox.ai API.