- Rang
- #51
- Gesamte Ausgabe-Token
- 347,963
- Antwortzeit (Durchschnitt)
- 26.77s
- Gesamtkosten
- $0.224
DeepSeek V4.1 Flash (low) vs Qwen3.6 Max Preview (medium)
Qwen3.6 Max Preview (medium) führt beim Durchschnittsscore mit 8.6 vs 8.5. DeepSeek V4.1 Flash (low) hat die niedrigeren Benchmark-Kosten mit $0.224 vs $1.132. DeepSeek V4.1 Flash (low) ist schneller mit 26.77s vs 66.52s, mit Erfolgsraten von 74.2% vs 83.3%.
Verglichene Modelle
- Rang
- #48
- Gesamte Ausgabe-Token
- 170,373
- Antwortzeit (Durchschnitt)
- 66.52s
- Gesamtkosten
- $1.132
Empfohlenes Modell
DeepSeek V4.1 Flash (low)
Die Punktzahl bleibt nah an der besten hier (8.5 vs 8.6) und es kostet etwa 5.1x weniger als Qwen3.6 Max Preview (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4.1 Flash DeepSeek V4.1 Flash low | Qwen3.6 Max Preview Qwen3.6 Max Preview medium |
|---|---|---|
| Punktzahl | 8.5 | 8.6 |
| Rang | #51 | #48 |
| Zuverlässigkeit | 9.5 | 10.0 |
| Konsistenz | 8.9 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 74.2% | 83.3% |
| Instabile Tests | 3 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 1.492 | 7.653 |
| Gesamtkosten | $0.224 | $1.132 |
| Eingabepreis | $0.150 / 1M | $1.028 / 1M |
| Ausgabepreis | $0.600 / 1M | $6.162 / 1M |
| Gesamte Eingabe-Token | 99,715 | 79,249 |
| Ausgabe-Token | 6,381 | 5,097 |
| Denk-Token | 341,582 | 165,276 |
| Antwortzeit (Durchschnitt) | 26.77s | 66.52s |
| Antwortzeit (Maximum) | 149.84s | 238.07s |
| Antwortzeit (Gesamt) | 589.01s | 1463.50s |
| Parameter | 748B insgesamt (16B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#51 DeepSeek V4.1 Flash
low- Kosten
- $0.017
- Zeit
- 43.6s
- Token
- 14,069 tok
#48 Qwen3.6 Max Preview
medium- Kosten
- $0.024
- Zeit
- 76.5s
- Token
- 3,861 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 8.3 | 10.0 | 75.0% | 0 | 3.32s | 852 | 171 | 4,328 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 40.66s | 7,509 | 378 | 81,978 | |
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 24.73s | 77,368 | 4,906 | 24,016 | |
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 6.5 | 10.0 | 50.0% | 0 | 3.80s | 2,397 | 120 | 1,149 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 3.5 | 4.4 | 33.3% | 2 | 95.58s | 909 | 27 | 184,701 | |
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.34s | 549 | 117 | 1,319 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 8.38s | 783 | 63 | 1,546 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 8.2 | 7.7 | 77.8% | 1 | 9.39s | 828 | 273 | 14,502 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 13.83s | 8,259 | 313 | 284 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 3.0 | 10.0 | 0.0% | 0 | 46.86s | 261 | 13 | 27,759 | |
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4.1 FlashlowvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.6mediumDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashlowvsGPT-5.2mediumDeepSeek V4.1 FlashlowvsQwen3.8 27BhighMuse Spark 1.2highvsQwen3.6 Max PreviewmediumSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashlowDeepSeek V4.1 FlashhighvsQwen3.6 Max PreviewmediumDeepSeek V4.1 FlashlowvsInkling SmallhighMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumQwen3.6 Max PreviewmediumvsGLM 5.3 FlashmaxGemini 3.6 FlashlowvsQwen3.6 Max Previewmedium