- Rang
- #89
- Gesamte Ausgabe-Token
- 234,594
- Antwortzeit (Durchschnitt)
- 55.99s
- Gesamtkosten
- $0.030
DeepSeek V4 Flash 0423 (high) vs Qwen3.6 Plus (medium)
DeepSeek V4 Flash 0423 (high) führt beim Durchschnittsscore mit 8.1 vs 7.3. DeepSeek V4 Flash 0423 (high) hat die niedrigeren Benchmark-Kosten mit $0.030 vs $0.554. DeepSeek V4 Flash 0423 (high) ist schneller mit 55.99s vs 57.41s, mit Erfolgsraten von 71.0% vs 69.6%.
Verglichene Modelle
- Rang
- #137
- Gesamte Ausgabe-Token
- 246,790
- Antwortzeit (Durchschnitt)
- 57.41s
- Gesamtkosten
- $0.554
Empfohlenes Modell
DeepSeek V4 Flash 0423 (high)
Es hat hier die beste Punktzahl (8.1) und kostet etwa 18.8x weniger als Qwen3.6 Plus (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high | Qwen3.6 Plus Qwen3.6 Plus medium |
|---|---|---|
| Punktzahl | 8.1 | 7.3 |
| Rang | #89 | #137 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.6 | 9.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 71.0% | 69.6% |
| Instabile Tests | 4 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.547 | 2.605 |
| Gesamtkosten | $0.030 | $0.554 |
| Eingabepreis | $0.042 / 1M | $0.325 / 1M |
| Ausgabepreis | $0.084 / 1M | $1.950 / 1M |
| Preis für Cache-Lesen | $0.009 / 1M | k. A. |
| Preis für Cache-Schreiben | k. A. | $0.407 / 1M |
| Gesamte Eingabe-Token | 298,794 | 222,601 |
| Ausgabe-Token | 45,873 | 8,185 |
| Denk-Token | 188,721 | 238,605 |
| Antwortzeit (Durchschnitt) | 55.99s | 57.41s |
| Antwortzeit (Maximum) | 218.13s | 307.08s |
| Antwortzeit (Gesamt) | 1287.87s | 1263.02s |
| Parameter | 284B insgesamt (13B aktiv) | ~397B insgesamt (~17B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#89 DeepSeek V4 Flash 0423
high- Kosten
- $0.003
- Zeit
- 93.1s
- Token
- 7,926 tok
#137 Qwen3.6 Plus
medium- Kosten
- $0.024
- Zeit
- 219.0s
- Token
- 12,235 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 148.13s | 190,314 | 8,644 | 14,640 | |
| Qwen3.6 Plus | 4.7 | 3.1 | 33.3% | 1 | 307.08s | 124,903 | 1,768 | 47,390 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.3 | 10.0 | 75.0% | 0 | 28.51s | 540 | 140 | 7,770 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 9.90s | 672 | 207 | 7,557 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 7.8 | 10.0 | 66.7% | 0 | 50.60s | 7,279 | 395 | 34,862 | |
| Qwen3.6 Plus | 6.1 | 7.8 | 44.4% | 1 | 153.12s | 7,098 | 58 | 50,586 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.4 | 5.8 | 66.7% | 1 | 104.10s | 82,663 | 4,633 | 37,533 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 163.25s | 71,058 | 5,011 | 55,925 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 28.03s | 7,290 | 201 | 1,179 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 14.95s | 7,782 | 270 | 10,706 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.6 | 7.2 | 22.2% | 1 | 115.42s | 754 | 22,778 | 79,643 | |
| Qwen3.6 Plus | 2.9 | 7.2 | 11.1% | 1 | 46.39s | 780 | 61 | 39,854 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.1 | 3.1 | 66.7% | 1 | 25.15s | 471 | 79 | 632 | |
| Qwen3.6 Plus | 5.1 | 10.0 | 0.0% | 0 | 27.05s | 516 | 111 | 5,232 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 15.36s | 627 | 63 | 1,622 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 7.54s | 699 | 102 | 5,552 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.2 | 7.2 | 88.9% | 1 | 26.11s | 594 | 196 | 1,767 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 6.34s | 696 | 309 | 6,712 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 74.73s | 8,079 | 228 | 542 | |
| Qwen3.6 Plus | 10.0 | 10.0 | 100.0% | 0 | 5.87s | 8,193 | 267 | 1,330 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 54.46s | 183 | 8,516 | 8,531 | |
| Qwen3.6 Plus | 3.0 | 10.0 | 0.0% | 0 | 47.51s | 204 | 21 | 7,761 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 4.7mediumvsDeepSeek V4 Flash 0423highLongCat 2.0highvsQwen3.6 PlusmediumQwen3.6 PlusmediumvsGLM 5.3 FlashhighGemini 3.8 FlashlowvsQwen3.6 PlusmediumSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highDeepSeek V4 Flash 0423highvsNemotron 3 UltramediumKostenlos verfügbarClaude Opus 4.8lowvsQwen3.6 PlusmediumDeepSeek V4 Flash 0423highvsGPT-5.4 NanomediumDeepSeek V4 Pro 0423nonevsQwen3.6 PlusmediumDeepSeek V4 Flash 0423highvsGemini 3.8 FlashmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highQwen3.6 PlusmediumvsStep 3.7 Flashlow