Qwen Flash
Chatbailian/qwen-flashQwen Flash ist das schnellste und günstigste Modell der Qwen-Familie von Alibaba, wird über Dashscope bereitgestellt und ist für latenzkritische Aufgaben ausgelegt. Es liefert ultraschnelle Inferenz und unterstützt Werkzeugaufrufe (Function Calling), Prompt-Caching und Websuche – bei Preisen von $0.022/M Tokens für Eingaben und $0.22/M für Ausgaben. Kontextfenster: 1M Tokens, Ausgabe: 32K. Verfügbar über die Protokolle OpenAI und Anthropic.
Kontextfenster
1M
Max. Ausgabe-Tokens
32K
Veröffentlicht
2025-07-28
Fähigkeiten
Function CallingPrompt CachingWebsuche
Verfügbare Anbieter
Aliyun
Unterstützte Protokolle
openaianthropic
Providers
Aliyun
Eingabe-Tokens
$0.022/M
Ausgabe-Tokens
$0.22/M
Cache-Lesen
$0.0043/M
Cache-Schreiben
$0.027/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verwandte Modelle
Häufig gestellte Fragen
Qwen Flash auf Ofox.ai kostet $0.022/M pro Million Eingabe-Tokens und $0.22/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.
Qwen Flash unterstützt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 32K Tokens, was die Verarbeitung großer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.ai/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.
Qwen Flash unterstützt folgende Fähigkeiten: Function Calling, Prompt Caching, Websuche. Zugriff auf alle Features über die einheitliche Ofox.ai API.