GPT-5.6 ist da 🎉 GPT 20 % Rabatt 🎉 Alle Modelle, den ganzen Juli 🔥Mehr erfahren
Qwen

Qwen Flash

Chat
bailian/qwen-flash
VergleichenLoslegen

Qwen Flash ist das schnellste und günstigste Modell der Qwen-Familie von Alibaba, wird über Dashscope bereitgestellt und ist für latenzkritische Aufgaben ausgelegt. Es liefert ultraschnelle Inferenz und unterstützt Werkzeugaufrufe (Function Calling), Prompt-Caching und Websuche – bei Preisen von $0.022/M Tokens für Eingaben und $0.22/M für Ausgaben. Kontextfenster: 1M Tokens, Ausgabe: 32K. Verfügbar über die Protokolle OpenAI und Anthropic.

Kontextfenster
1M
Max. Ausgabe-Tokens
32K
Veröffentlicht
2025-07-28
Fähigkeiten
Function CallingPrompt CachingWebsuche
Verfügbare Anbieter
BaiLianAliyun
Unterstützte Protokolle
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Eingabe-Tokens
$0.022/M
Ausgabe-Tokens
$0.22/M
Cache-Lesen
$0.0043/M
Cache-Schreiben
$0.027/M
Websuche
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Häufig gestellte Fragen

Qwen Flash auf Ofox.ai kostet $0.022/M pro Million Eingabe-Tokens und $0.22/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.