- Rang
- #97
- Gesamte Ausgabe-Token
- 211,310
- Antwortzeit (Durchschnitt)
- 51.81s
- Gesamtkosten
- $0.042
DeepSeek V4 Flash 0423 (high) vs Qwen3.6 Max Preview (medium)
Qwen3.6 Max Preview (medium) führt beim Durchschnittsscore mit 8.6 vs 7.6. DeepSeek V4 Flash 0423 (high) hat die niedrigeren Benchmark-Kosten mit $0.042 vs $1.132. DeepSeek V4 Flash 0423 (high) ist schneller mit 51.81s vs 66.52s, mit Erfolgsraten von 69.7% vs 83.3%.
Verglichene Modelle
- Rang
- #49
- Gesamte Ausgabe-Token
- 170,373
- Antwortzeit (Durchschnitt)
- 66.52s
- Gesamtkosten
- $1.132
Empfohlenes Modell
DeepSeek V4 Flash 0423 (high)
Es bietet den besten Gesamtkompromiss: wettbewerbsfähige Punktzahl (7.6), niedrigere Kosten als Qwen3.6 Max Preview (medium) und ausgewogene Antwortzeit.
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high | Qwen3.6 Max Preview Qwen3.6 Max Preview medium |
|---|---|---|
| Punktzahl | 7.6 | 8.6 |
| Rang | #97 | #49 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.5 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 69.7% | 83.3% |
| Instabile Tests | 4 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.446 | 7.653 |
| Gesamtkosten | $0.042 | $1.132 |
| Eingabepreis | $0.089 / 1M | $1.028 / 1M |
| Ausgabepreis | $0.178 / 1M | $6.162 / 1M |
| Gesamte Eingabe-Token | 108,480 | 79,249 |
| Ausgabe-Token | 37,229 | 5,097 |
| Denk-Token | 174,081 | 165,276 |
| Antwortzeit (Durchschnitt) | 51.81s | 66.52s |
| Antwortzeit (Maximum) | 218.13s | 238.07s |
| Antwortzeit (Gesamt) | 1139.75s | 1463.50s |
| Parameter | 284B insgesamt (13B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#97 DeepSeek V4 Flash 0423
high- Kosten
- $0.003
- Zeit
- 93.1s
- Token
- 7,926 tok
#49 Qwen3.6 Max Preview
medium- Kosten
- $0.024
- Zeit
- 76.5s
- Token
- 3,861 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.3 | 10.0 | 75.0% | 0 | 28.51s | 540 | 140 | 7,770 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 7.8 | 10.0 | 66.7% | 0 | 50.60s | 7,279 | 395 | 34,862 | |
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.4 | 5.8 | 66.7% | 1 | 104.10s | 82,663 | 4,633 | 37,533 | |
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 28.03s | 7,290 | 201 | 1,179 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.6 | 7.2 | 22.2% | 1 | 115.42s | 754 | 22,778 | 79,643 | |
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.1 | 3.1 | 66.7% | 1 | 25.15s | 471 | 79 | 632 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 15.36s | 627 | 63 | 1,622 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.2 | 7.2 | 88.9% | 1 | 26.11s | 594 | 196 | 1,767 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 74.73s | 8,079 | 228 | 542 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 54.46s | 183 | 8,516 | 8,531 | |
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 4.6mediumvsDeepSeek V4 Flash 0423highSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highDeepSeek V4 Flash 0423highvsGLM 5mediumDeepSeek V4 Flash 0423highvsSolar Pro 4xhighDeepSeek V4 Flash 0423highvsNemotron 3 UltramediumKostenlos verfügbarClaude Opus 5nonevsDeepSeek V4 Flash 0423highMuse Spark 1.2highvsQwen3.6 Max PreviewmediumDeepSeek V4.1 FlashlowvsQwen3.6 Max PreviewmediumDeepSeek V4.1 FlashhighvsQwen3.6 Max PreviewmediumDeepSeek V4 Flash 0423highvsGPT-5.4 NanomediumClaude Opus 4.8lowvsDeepSeek V4 Flash 0423highSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423high