GPT-5.6 ist da 🎉 GPT 20 % Rabatt 🎉 Alle Modelle, den ganzen Juli đŸ”„Mehr erfahren
Qwen

Qwen: Qwen3.5 Flash

Chat
bailian/qwen3.5-flash
VergleichenLoslegen

Qwen3.5-Flash ist Alibabas geschwindigkeitsoptimiertes Vision-Language-Modell in der Qwen3.5-Serie mit einem Hybrid-Design aus linearer Attention und Sparse MoE fĂŒr hohen Inferenz-Durchsatz. Es zeigt signifikante Verbesserungen gegenĂŒber Qwen3 Flash bei Text- und Multimodal-Aufgaben. Context: 1M tokens, Output: 64K. VerfĂŒgbar ĂŒber OpenAI- und Anthropic-Protocol.

Kontextfenster
1M
Max. Ausgabe-Tokens
64K
Veröffentlicht
2026-02-23
FĂ€higkeiten
VisionFunction CallingReasoningPrompt CachingVideo-Eingabe
VerfĂŒgbare Anbieter
BaiLianAliyun
UnterstĂŒtzte Protokolle
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Eingabe-Tokens
$0.1/M
Ausgabe-Tokens
$0.4/M
Cache-Lesen
$0.01/M
Cache-Schreiben
$0.125/M
Websuche
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.ai/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3.5-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Benchmarks

LMArena ↗Bewertet als qwen3.5-flash

Qwen: Qwen3.5 Flash erreicht 1398 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 129 von 374 Modellen, basierend auf 53.387 menschlichen PrÀferenzstimmen (aktualisiert am 2026-07-12).

Benchmark-Ergebnisse von qwen3.5-flash auf LMArena
KategorieArena-Score95%-KIPlatzStimmen
Gesamt13981394–1402Platz 129 von 37453.387
Schwierige Prompts14151411–1420Platz 134 von 37434.166
Programmierung14371431–1443Platz 134 von 36915.155
Mathematik14041393–1416Platz 117 von 3622.952
Kreatives Schreiben13391332–1347Platz 155 von 3728.270
Anweisungsbefolgung13821376–1388Platz 137 von 37416.970
Chinesisch14511438–1463Platz 101 von 3442.528

Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik ↗ · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen PrĂ€ferenzbewertungen Dritter, nicht von OFOX.

HĂ€ufig gestellte Fragen

Qwen: Qwen3.5 Flash auf Ofox.ai kostet $0.1/M pro Million Eingabe-Tokens und $0.4/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen GebĂŒhren.