- Rang
- #74
- Gesamte Ausgabe-Token
- 532,511
- Antwortzeit (Durchschnitt)
- 118.83s
- Gesamtkosten
- $0.580
DeepSeek V4 Flash 0731 (high) vs Qwen3.7 Max (medium)
Qwen3.7 Max (medium) führt beim Durchschnittsscore mit 8.5 vs 8.4. DeepSeek V4 Flash 0731 (high) hat die niedrigeren Benchmark-Kosten mit $0.580 vs $1.689. Qwen3.7 Max (medium) ist schneller mit 48.35s vs 118.83s, mit Erfolgsraten von 76.8% vs 85.5%.
Verglichene Modelle
- Rang
- #67
- Gesamte Ausgabe-Token
- 259,032
- Antwortzeit (Durchschnitt)
- 48.35s
- Gesamtkosten
- $1.689
Empfohlenes Modell
DeepSeek V4 Flash 0731 (high)
Die Punktzahl bleibt nah an der besten hier (8.4 vs 8.5) und es kostet etwa 2.9x weniger als Qwen3.7 Max (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high | Qwen3.7 Max Qwen3.7 Max medium |
|---|---|---|
| Punktzahl | 8.4 | 8.5 |
| Rang | #74 | #67 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.1 | 8.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 76.8% | 85.5% |
| Instabile Tests | 5 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 1.069 | 12.033 |
| Gesamtkosten | $0.580 | $1.689 |
| Eingabepreis | $0.018 / 1M | $1.475 / 1M |
| Ausgabepreis | $1.280 / 1M | $4.425 / 1M |
| Preis für Cache-Lesen | $0.018 / 1M | $0.295 / 1M |
| Preis für Cache-Schreiben | k. A. | $1.844 / 1M |
| Gesamte Eingabe-Token | 281,863 | 367,848 |
| Ausgabe-Token | 24,535 | 8,753 |
| Denk-Token | 507,976 | 250,279 |
| Antwortzeit (Durchschnitt) | 118.83s | 48.35s |
| Antwortzeit (Maximum) | 600.61s | 556.06s |
| Antwortzeit (Gesamt) | 2733.01s | 1112.11s |
| Parameter | 284B insgesamt (13B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#74 DeepSeek V4 Flash 0731
high
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 187.3s
- Token
- 19,048 tok
#67 Qwen3.7 Max
medium- Kosten
- $0.017
- Zeit
- 68.8s
- Token
- 4,526 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 204.36s | 185,161 | 7,569 | 11,635 | |
| Qwen3.7 Max | 6.1 | 3.1 | 66.7% | 1 | 137.00s | 261,819 | 3,005 | 29,925 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.7 | 7.9 | 91.7% | 1 | 13.62s | 1,488 | 542 | 10,576 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.36s | 672 | 222 | 8,742 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.3 | 6.3 | 55.6% | 1 | 252.67s | 7,044 | 2,160 | 191,210 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 87.10s | 67,283 | 11,903 | 41,397 | |
| Qwen3.7 Max | 8.7 | 6.9 | 83.3% | 1 | 287.83s | 78,594 | 3,985 | 96,450 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 7,764 | 336 | 1,259 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.80s | 7,782 | 270 | 6,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.5 | 4.4 | 33.3% | 2 | 458.65s | 700 | 104 | 215,629 | |
| Qwen3.7 Max | 4.1 | 4.4 | 44.5% | 2 | 52.45s | 780 | 61 | 41,143 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.64s | 708 | 72 | 533 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 11.70s | 516 | 135 | 4,457 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 4.46s | 1,101 | 119 | 939 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 7.46s | 699 | 102 | 5,452 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.7 | 77.8% | 1 | 9.36s | 1,305 | 397 | 6,801 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.84s | 696 | 259 | 8,908 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.42s | 8,889 | 357 | 451 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.63s | 8,193 | 267 | 1,220 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 110.63s | 420 | 976 | 27,546 | |
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 33.37s | 204 | 24 | 12,920 |
Schnellvergleich
Vergleichspaar wechseln
Muse Spark 1.3lowvsQwen3.7 MaxmediumQwen3.7 MaxmediumvsGrok 4.6highDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsKimi K3maxMuse Glimmer 30BxhighvsQwen3.7 MaxmediumClaude Sonnet 5.5highvsQwen3.7 MaxmediumClaude Sonnet 5.5xhighvsQwen3.7 MaxmediumMuse Spark 1.1lowvsQwen3.7 MaxmediumDeepSeek V4 Flash 0731highvsGPT-6 Lunamedium