- Rang
- #52
- Gesamte Ausgabe-Token
- 452,940
- Antwortzeit (Durchschnitt)
- 32.78s
- Gesamtkosten
- $0.287
DeepSeek V4.1 Flash (high) vs Qwen3.6 Max Preview (medium)
Qwen3.6 Max Preview (medium) führt beim Durchschnittsscore mit 8.6 vs 8.5. DeepSeek V4.1 Flash (high) hat die niedrigeren Benchmark-Kosten mit $0.287 vs $1.132. DeepSeek V4.1 Flash (high) ist schneller mit 32.78s vs 66.52s, mit Erfolgsraten von 74.2% vs 83.3%.
Verglichene Modelle
- Rang
- #48
- Gesamte Ausgabe-Token
- 170,373
- Antwortzeit (Durchschnitt)
- 66.52s
- Gesamtkosten
- $1.132
Empfohlenes Modell
DeepSeek V4.1 Flash (high)
Die Punktzahl bleibt nah an der besten hier (8.5 vs 8.6) und es kostet etwa 3.9x weniger als Qwen3.6 Max Preview (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4.1 Flash DeepSeek V4.1 Flash high | Qwen3.6 Max Preview Qwen3.6 Max Preview medium |
|---|---|---|
| Punktzahl | 8.5 | 8.6 |
| Rang | #52 | #48 |
| Zuverlässigkeit | 9.6 | 10.0 |
| Konsistenz | 8.9 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 74.2% | 83.3% |
| Instabile Tests | 3 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 1.912 | 7.653 |
| Gesamtkosten | $0.287 | $1.132 |
| Eingabepreis | $0.150 / 1M | $1.028 / 1M |
| Ausgabepreis | $0.600 / 1M | $6.162 / 1M |
| Gesamte Eingabe-Token | 100,111 | 79,249 |
| Ausgabe-Token | 6,642 | 5,097 |
| Denk-Token | 446,298 | 165,276 |
| Antwortzeit (Durchschnitt) | 32.78s | 66.52s |
| Antwortzeit (Maximum) | 205.53s | 238.07s |
| Antwortzeit (Gesamt) | 721.15s | 1463.50s |
| Parameter | 748B insgesamt (16B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#52 DeepSeek V4.1 Flash
high- Kosten
- $0.035
- Zeit
- 111.0s
- Token
- 29,201 tok
#48 Qwen3.6 Max Preview
medium- Kosten
- $0.024
- Zeit
- 76.5s
- Token
- 3,861 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 8.3 | 10.0 | 75.0% | 0 | 3.42s | 852 | 170 | 5,348 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 49.19s | 7,509 | 376 | 108,285 | |
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 27.63s | 77,764 | 5,152 | 31,635 | |
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 6.5 | 10.0 | 50.0% | 0 | 4.19s | 2,397 | 120 | 1,584 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 5.3 | 7.2 | 44.4% | 1 | 127.30s | 909 | 28 | 249,623 | |
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.16s | 549 | 120 | 1,130 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 7.06s | 783 | 63 | 1,972 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 6.4 | 4.9 | 66.7% | 2 | 14.27s | 828 | 339 | 23,969 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 15.28s | 8,259 | 258 | 506 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 3.0 | 10.0 | 0.0% | 0 | 38.05s | 261 | 16 | 22,246 | |
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashhighvsMuse Spark 1.2lowDeepSeek V4.1 FlashhighvsGrok 4.6mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGrok 4.5lowDeepSeek V4.1 FlashhighvsGPT-5.2mediumDeepSeek V4.1 FlashhighvsQwen3.8 MaxlowMuse Spark 1.2highvsQwen3.6 Max PreviewmediumSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashhighDeepSeek V4.1 FlashlowvsQwen3.6 Max PreviewmediumMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumQwen3.6 Max PreviewmediumvsGLM 5.3 Flashmax