- Rang
- #85
- Gesamte Ausgabe-Token
- 513,307
- Antwortzeit (Durchschnitt)
- 114.94s
- Gesamtkosten
- $0.279
DeepSeek V4 Flash 0731 (high) vs Qwen3.8 2.4T A95B (low)
Qwen3.8 2.4T A95B (low) führt beim Durchschnittsscore mit 8.1 vs 8.0. DeepSeek V4 Flash 0731 (high) hat die niedrigeren Benchmark-Kosten mit $0.279 vs $2.672. DeepSeek V4 Flash 0731 (high) ist schneller mit 114.94s vs 118.97s, mit Erfolgsraten von 75.8% vs 72.7%.
Verglichene Modelle
- Rang
- #78
- Gesamte Ausgabe-Token
- 495,541
- Antwortzeit (Durchschnitt)
- 118.97s
- Gesamtkosten
- $2.672
Empfohlenes Modell
DeepSeek V4 Flash 0731 (high)
Die Punktzahl bleibt nah an der besten hier (8.0 vs 8.1) und es kostet etwa 9.6x weniger als Qwen3.8 2.4T A95B (low).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high | Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low |
|---|---|---|
| Punktzahl | 8.0 | 8.1 |
| Rang | #85 | #78 |
| Zuverlässigkeit | 10.0 | 9.4 |
| Konsistenz | 8.0 | 9.2 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 75.8% | 72.7% |
| Instabile Tests | 5 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.956 | 17.812 |
| Gesamtkosten | $0.279 | $2.672 |
| Eingabepreis | $0.040 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.640 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 96,702 | 113,279 |
| Ausgabe-Token | 16,966 | 121,045 |
| Denk-Token | 496,341 | 374,496 |
| Antwortzeit (Durchschnitt) | 114.94s | 118.97s |
| Antwortzeit (Maximum) | 600.61s | 534.21s |
| Antwortzeit (Gesamt) | 2528.65s | 2617.41s |
| Parameter | 284B insgesamt (13B aktiv) | 2.4T insgesamt (95B aktiv) |
| Verfügbarkeit | Geschlossen | Gewichte verfügbar |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#85 DeepSeek V4 Flash 0731
high
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 187.3s
- Token
- 19,048 tok
#78 Qwen3.8 2.4T A95B
low- Kosten
- $0.100
- Zeit
- 193.2s
- Token
- 16,767 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.7 | 7.9 | 91.7% | 1 | 13.62s | 1,488 | 542 | 10,576 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.04s | 1,104 | 397 | 4,814 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.3 | 6.3 | 55.6% | 1 | 252.67s | 7,044 | 2,160 | 191,210 | |
| Qwen3.8 2.4T A95B | 7.8 | 9.3 | 66.7% | 0 | 172.53s | 6,716 | 21,405 | 57,399 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 87.10s | 67,283 | 11,903 | 41,397 | |
| Qwen3.8 2.4T A95B | 8.2 | 6.9 | 66.7% | 1 | 231.85s | 85,267 | 8,008 | 50,681 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 7,764 | 336 | 1,259 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.27s | 7,956 | 839 | 2,445 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.5 | 4.4 | 33.3% | 2 | 458.65s | 700 | 104 | 215,629 | |
| Qwen3.8 2.4T A95B | 3.2 | 9.3 | 0.0% | 0 | 287.65s | 1,008 | 16,133 | 156,114 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.64s | 708 | 72 | 533 | |
| Qwen3.8 2.4T A95B | 6.1 | 3.1 | 66.7% | 1 | 22.97s | 606 | 44 | 1,497 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 4.46s | 1,101 | 119 | 939 | |
| Qwen3.8 2.4T A95B | 9.8 | 10.0 | 100.0% | 0 | 19.54s | 903 | 263 | 1,480 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.7 | 77.8% | 1 | 9.36s | 1,305 | 397 | 6,801 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 43.37s | 1,026 | 1,154 | 25,563 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.42s | 8,889 | 357 | 451 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 25.88s | 8,481 | 302 | 975 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 110.63s | 420 | 976 | 27,546 | |
| Qwen3.8 2.4T A95B | 3.0 | 10.0 | 0.0% | 0 | 422.46s | 212 | 72,500 | 73,528 |
Schnellvergleich
Vergleichspaar wechseln
GPT-5 MinimediumvsQwen3.8 2.4T A95BlowMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsGrok 4.7mediumQwen3.8 2.4T A95BlowvsGrok 4.7mediumQwen3.8 2.4T A95BlowvsInklinghighMuse Spark 1.1highvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsInklingmediumDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsGrok 4.7lowClaude Sonnet 5mediumvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsKimi K3max