GPT-5.6 ist da 🎉 GPT 20 % Rabatt 🎉 Alle Modelle, den ganzen Juli đŸ”„Mehr erfahren
Qwen

Qwen3 Coder Flash

Chat
bailian/qwen3-coder-flash
VergleichenLoslegen

Qwen3-Coder-Flash ist Alibabas kosteneffizientes Coding-Modell auf Basis der Qwen3-Architektur. Es erbt die agentischen Coding-FĂ€higkeiten von Qwen3-Coder-Plus, unterstĂŒtzt Multi-Turn-Tool-Interaktion und ist fĂŒr Repository-Level-Code-VerstĂ€ndnis mit verbesserter Tool-Call-StabilitĂ€t optimiert. Context Window: 1M tokens, Output: 64K. VerfĂŒgbar ĂŒber OpenAI- und Anthropic-Protocol.

Kontextfenster
1M
Max. Ausgabe-Tokens
64K
Veröffentlicht
2025-08-05
FĂ€higkeiten
Function CallingReasoningPrompt Caching
VerfĂŒgbare Anbieter
BaiLianAliyun
UnterstĂŒtzte Protokolle
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Eingabe-Tokens
$0.5/M
Ausgabe-Tokens
$2.5/M
Cache-Lesen
$0.06/M
Cache-Schreiben
$0.27/M
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3-coder-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

HĂ€ufig gestellte Fragen

Qwen3 Coder Flash auf Ofox.ai kostet $0.5/M pro Million Eingabe-Tokens und $2.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen GebĂŒhren.