- Rang
- #75
- Gesamte Ausgabe-Token
- 513,307
- Antwortzeit (Durchschnitt)
- 114.94s
- Gesamtkosten
- $0.058
DeepSeek V4 Flash 0731 (high) vs Qwen3.7 Plus (medium)
DeepSeek V4 Flash 0731 (high) führt beim Durchschnittsscore mit 8.0 vs 7.9. DeepSeek V4 Flash 0731 (high) hat die niedrigeren Benchmark-Kosten mit $0.058 vs $0.277. Qwen3.7 Plus (medium) ist schneller mit 53.51s vs 114.94s, mit Erfolgsraten von 75.8% vs 75.8%.
Verglichene Modelle
- Rang
- #83
- Gesamte Ausgabe-Token
- 187,337
- Antwortzeit (Durchschnitt)
- 53.51s
- Gesamtkosten
- $0.277
Empfohlenes Modell
DeepSeek V4 Flash 0731 (high)
Es hat hier die beste Punktzahl (8.0) und kostet etwa 4.8x weniger als Qwen3.7 Plus (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high | Qwen3.7 Plus Qwen3.7 Plus medium |
|---|---|---|
| Punktzahl | 8.0 | 7.9 |
| Rang | #75 | #83 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.0 | 8.9 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 75.8% | 75.8% |
| Instabile Tests | 5 | 3 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.956 | 2.134 |
| Gesamtkosten | $0.058 | $0.277 |
| Eingabepreis | $0.060 / 1M | $0.320 / 1M |
| Ausgabepreis | $0.120 / 1M | $1.280 / 1M |
| Gesamte Eingabe-Token | 96,702 | 115,242 |
| Ausgabe-Token | 16,966 | 6,163 |
| Denk-Token | 496,341 | 181,174 |
| Antwortzeit (Durchschnitt) | 114.94s | 53.51s |
| Antwortzeit (Maximum) | 600.61s | 315.30s |
| Antwortzeit (Gesamt) | 2528.65s | 1177.25s |
| Parameter | 284B insgesamt (13B aktiv) | ~397B insgesamt (~17B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#75 DeepSeek V4 Flash 0731
high
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 187.3s
- Token
- 19,048 tok
#83 Qwen3.7 Plus
medium- Kosten
- $0.018
- Zeit
- 193.2s
- Token
- 10,821 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.7 | 7.9 | 91.7% | 1 | 13.62s | 1,488 | 542 | 10,576 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 8.58s | 672 | 195 | 5,065 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.3 | 6.3 | 55.6% | 1 | 252.67s | 7,044 | 2,160 | 191,210 | |
| Qwen3.7 Plus | 6.1 | 6.6 | 55.6% | 1 | 108.60s | 6,472 | 414 | 43,576 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 87.10s | 67,283 | 11,903 | 41,397 | |
| Qwen3.7 Plus | 8.2 | 6.9 | 66.7% | 1 | 190.27s | 89,228 | 4,403 | 57,645 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 7,764 | 336 | 1,259 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 21.75s | 7,782 | 270 | 6,713 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.5 | 4.4 | 33.3% | 2 | 458.65s | 700 | 104 | 215,629 | |
| Qwen3.7 Plus | 3.6 | 7.2 | 22.2% | 1 | 60.05s | 780 | 58 | 34,980 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.64s | 708 | 72 | 533 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 25.48s | 516 | 123 | 3,998 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 4.46s | 1,101 | 119 | 939 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 16.13s | 699 | 102 | 5,013 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.7 | 77.8% | 1 | 9.36s | 1,305 | 397 | 6,801 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 16.38s | 696 | 280 | 7,312 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.42s | 8,889 | 357 | 451 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 15.02s | 8,193 | 292 | 1,831 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 110.63s | 420 | 976 | 27,546 | |
| Qwen3.7 Plus | 3.0 | 10.0 | 0.0% | 0 | 91.07s | 204 | 26 | 15,041 |
Schnellvergleich
Vergleichspaar wechseln
GPT-5.2 ChatnonevsQwen3.7 PlusmediumKimi K3maxvsQwen3.7 PlusmediumDeepSeek V4 Flash 0731highvsInklingmediumDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowGPT-5.6 TerrahighvsQwen3.7 PlusmediumDeepSeek V4 Flash 0731highvsKimi K3maxDeepSeek V4 Flash 0731highvsGPT-5.2 ChatnoneDeepSeek V4 Flash 0731highvsStep 3.7 FlashmediumClaude Opus 4.8lowvsQwen3.7 PlusmediumDeepSeek V4 Flash 0731highvsQwen3.8 27Blow