Qwen

Qwen: Qwen3.5 Flash

Chat
bailian/qwen3.5-flash
VergleichenLoslegen

Qwen3.5-Flash ist Alibabas geschwindigkeitsoptimiertes Vision-Language-Modell in der Qwen3.5-Serie mit einem Hybrid-Design aus linearer Attention und Sparse MoE für hohen Inferenz-Durchsatz. Es zeigt signifikante Verbesserungen gegenüber Qwen3 Flash bei Text- und Multimodal-Aufgaben. Context: 1M tokens, Output: 64K. Verfügbar über OpenAI- und Anthropic-Protocol.

Kontextfenster
1M
Max. Ausgabe-Tokens
64K
Veröffentlicht
2026-02-23
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingVideo-Eingabe
Verfügbare Anbieter
BaiLianAliyun
Unterstützte Protokolle
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Eingabe-Tokens
$0.1/M
Ausgabe-Tokens
$0.4/M
Cache-Lesen
$0.01/M
Cache-Schreiben
$0.125/M
Websuche
$0.01/R
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3.5-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Benchmarks

LMArenaBewertet als qwen3.5-flash

Qwen: Qwen3.5 Flash erreicht 1398 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 129 von 374 Modellen, basierend auf 53.387 menschlichen Präferenzstimmen (aktualisiert am 2026-07-12).

Benchmark-Ergebnisse von qwen3.5-flash auf LMArena
KategorieArena-Score95%-KIPlatzStimmen
Gesamt139813941402Platz 129 von 37453.387
Schwierige Prompts141514111420Platz 134 von 37434.166
Programmierung143714311443Platz 134 von 36915.155
Mathematik140413931416Platz 117 von 3622.952
Kreatives Schreiben133913321347Platz 155 von 3728.270
Anweisungsbefolgung138213761388Platz 137 von 37416.970
Chinesisch145114381463Platz 101 von 3442.528

Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen Präferenzbewertungen Dritter, nicht von OFOX.

Häufig gestellte Fragen

Qwen: Qwen3.5 Flash auf Ofox.ai kostet $0.1/M pro Million Eingabe-Tokens und $0.4/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.