- Punktzahl
- 8.0 (+0.86 Punkte)
- Gesamtkosten (aktueller Preis)
- $0.045 · 77.0% günstiger
- Antwortzeit (Durchschnitt)
- 23.66s · 77.0% schneller
Zusammenfassung
Qwen3.8 Flash Next erreicht 7.1 bei AI BENCHY und liegt auf #154. Das Modell hat 9.9 Zuverlässigkeit, 72.5% Erfolgsrate, ~$0.195 Gesamtkosten und 102.66s durchschnittliche Antwortzeit.
Was Qwen3.8 Flash Next besonders macht: Es nutzt ungewöhnlich viele Reasoning-Tokens, was langsamere oder teurere Läufe erklären kann.
Empfohlene Alternativen
Wir empfehlen stattdessen dieses Modell:
Modelldaten
Recherchiert am 2026-10-04
- Parameter
- 180B insgesamt (6B aktiv)
- Architektur
- MoE
- Verfügbarkeit
- Gewichte verfügbar
- Lizenz
- Qwen Community License 1.0
7.1
Konsistenz
7.9
Gesamtkosten (aktueller Preis)
~$0.195
Gesamte Ausgabe-Token
621,056
Gesamte Eingabe-Token
301,749
Geschätzte Stromkosten des Benchmarks
~$0.195
Instabile Tests
6
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#154 Qwen3.8 Flash Next
xhigh- Kosten
- ~$0.010
- Zeit
- 333.1s
- Token
- 30,654 tok
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Top-Modelle nach Score
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Schnellvergleich
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Agentenaufgaben | 4.7 | 3.1 | |
| Anti-KI-Tricks | 10.0 | 10.0 | |
| Programmierung | 7.4 | 7.0 | |
| Kombiniert | 7.3 | 5.8 | |
| Datenanalyse und -extraktion | 10.0 | 10.0 | |
| Domänenspezifisch | 3.5 | 4.4 | |
| Allgemeine Intelligenz | 4.7 | 3.1 | |
| Befolgung von Anweisungen | 9.8 | 10.0 | |
| Rätsellösen | 7.7 | 10.0 | |
| Werkzeugaufrufe | 10.0 | 10.0 | |
| Allgemeinwissen | 3.0 | 10.0 |