Advertise here
#96

Qwen3.8 Flash Next

Qwen Veröffentlichung: 2026-10-04 Getestet am: 2026-10-05 01:34 qwen/qwen3.8-flash-next::low
180B insgesamt (6B aktiv)MoEGewichte verfügbar

Zusammenfassung

Qwen3.8 Flash Next erreicht 8.0 bei AI BENCHY und liegt auf #96. Das Modell hat 10.0 Zuverlässigkeit, 79.7% Erfolgsrate, ~$0.045 Gesamtkosten und 23.66s durchschnittliche Antwortzeit.

Was Qwen3.8 Flash Next besonders macht: Am stärksten ist es in Programmierung, wo es #1 erreicht; am schwächsten ist Allgemeine Intelligenz mit #14.

Modelldaten

Recherchiert am 2026-10-04

Angegeben
Parameter
180B insgesamt (6B aktiv)
Architektur
MoE
Verfügbarkeit
Gewichte verfügbar
Lizenz
Qwen Community License 1.0

Punktzahl

8.0

Konsistenz

8.0

Gesamtkosten (aktueller Preis)

~$0.045

Gesamte Ausgabe-Token

135,295

Gesamte Eingabe-Token

342,163

Geschätzte Stromkosten des Benchmarks

~$0.045

Korrekte Tests

Falsche Tests: 8

Erfolgsquote pro Versuch: 79.7%

Instabile Tests

6

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

23.66s

Antwortzeit (Maximum): 166.72s

Antwortzeit (Gesamt): 544.16s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 Qwen3.8 Flash Next

low
Kosten
~$0.002
Zeit
47.2s
Token
5,270 tok

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Agentenaufgaben 6.1 3.1
Anti-KI-Tricks 10.0 10.0
Programmierung 10.0 10.0
Kombiniert 6.9 5.9
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 4.1 4.4
Allgemeine Intelligenz 4.7 3.1
Befolgung von Anweisungen 9.8 10.0
Rätsellösen 8.7 7.8
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle