- Punktzahl
- 8.0 (+0.39 Punkte)
- Gesamtkosten (aktueller Preis)
- $0.045 · 4.6% günstiger
- Antwortzeit (Durchschnitt)
- 23.66s · 4.6% schneller
Zusammenfassung
Qwen3.8 Flash Next erreicht 7.6 bei AI BENCHY und liegt auf #119. Das Modell hat 10.0 Zuverlässigkeit, 75.4% Erfolgsrate, ~$0.047 Gesamtkosten und 24.79s durchschnittliche Antwortzeit.
Was Qwen3.8 Flash Next besonders macht: Am stärksten ist es in Programmierung, wo es #1 erreicht; am schwächsten ist Agentenaufgaben mit #17.
Empfohlene Alternativen
Wir empfehlen stattdessen dieses Modell:
Modelldaten
Recherchiert am 2026-10-04
- Parameter
- 180B insgesamt (6B aktiv)
- Architektur
- MoE
- Verfügbarkeit
- Gewichte verfügbar
- Lizenz
- Qwen Community License 1.0
7.6
Konsistenz
7.9
10.0
Gesamtkosten (aktueller Preis)
~$0.047
Gesamte Ausgabe-Token
143,965
Gesamte Eingabe-Token
278,792
Geschätzte Stromkosten des Benchmarks
~$0.047
Instabile Tests
6
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#119 Qwen3.8 Flash Next
medium- Kosten
- ~$0.002
- Zeit
- 40.7s
- Token
- 4,059 tok
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Top-Modelle nach Score
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Schnellvergleich
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Agentenaufgaben | 4.7 | 3.1 | |
| Anti-KI-Tricks | 10.0 | 10.0 | |
| Programmierung | 10.0 | 10.0 | |
| Kombiniert | 6.4 | 5.8 | |
| Datenanalyse und -extraktion | 10.0 | 10.0 | |
| Domänenspezifisch | 2.9 | 4.4 | |
| Allgemeine Intelligenz | 4.8 | 3.2 | |
| Befolgung von Anweisungen | 9.8 | 10.0 | |
| Rätsellösen | 8.2 | 7.2 | |
| Werkzeugaufrufe | 10.0 | 10.0 | |
| Allgemeinwissen | 3.0 | 10.0 |