- Rang
- #97
- Gesamte Ausgabe-Token
- 211,310
- Antwortzeit (Durchschnitt)
- 51.81s
- Gesamtkosten
- $0.042
DeepSeek V4 Flash 0423 (high) vs Gemini 2.5 Flash (medium)
Gemini 2.5 Flash (medium) führt beim Durchschnittsscore mit 8.2 vs 7.6. DeepSeek V4 Flash 0423 (high) hat die niedrigeren Benchmark-Kosten mit $0.042 vs $0.644. Gemini 2.5 Flash (medium) ist schneller mit 21.14s vs 51.81s, mit Erfolgsraten von 69.7% vs 71.2%.
Verglichene Modelle
- Rang
- #66
- Gesamte Ausgabe-Token
- 241,365
- Antwortzeit (Durchschnitt)
- 21.14s
- Gesamtkosten
- $0.644
Empfohlenes Modell
DeepSeek V4 Flash 0423 (high)
Die Punktzahl bleibt nah an der besten hier (7.6 vs 8.2) und es kostet etwa 15.5x weniger als Gemini 2.5 Flash (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high | Gemini 2.5 Flash Gemini 2.5 Flash medium |
|---|---|---|
| Punktzahl | 7.6 | 8.2 |
| Rang | #97 | #66 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.5 | 9.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 69.7% | 71.2% |
| Instabile Tests | 4 | 1 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.446 | 4.288 |
| Gesamtkosten | $0.042 | $0.644 |
| Eingabepreis | $0.089 / 1M | $0.300 / 1M |
| Ausgabepreis | $0.178 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 108,480 | 132,507 |
| Ausgabe-Token | 37,229 | 12,739 |
| Denk-Token | 174,081 | 228,626 |
| Antwortzeit (Durchschnitt) | 51.81s | 21.14s |
| Antwortzeit (Maximum) | 218.13s | 140.50s |
| Antwortzeit (Gesamt) | 1139.75s | 465.10s |
| Parameter | 284B insgesamt (13B aktiv) | ~350B insgesamt (~20B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#97 DeepSeek V4 Flash 0423
high- Kosten
- $0.003
- Zeit
- 93.1s
- Token
- 7,926 tok
#66 Gemini 2.5 Flash
medium
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 274.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.3 | 10.0 | 75.0% | 0 | 28.51s | 540 | 140 | 7,770 | |
| Gemini 2.5 Flash | 8.4 | 10.0 | 75.0% | 0 | 6.30s | 492 | 255 | 10,233 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 7.8 | 10.0 | 66.7% | 0 | 50.60s | 7,279 | 395 | 34,862 | |
| Gemini 2.5 Flash | 7.8 | 10.0 | 66.7% | 0 | 41.01s | 6,669 | 543 | 32,303 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.4 | 5.8 | 66.7% | 1 | 104.10s | 82,663 | 4,633 | 37,533 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 84.47s | 110,544 | 11,112 | 95,241 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 28.03s | 7,290 | 201 | 1,179 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.06s | 7,257 | 279 | 2,325 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.6 | 7.2 | 22.2% | 1 | 115.42s | 754 | 22,778 | 79,643 | |
| Gemini 2.5 Flash | 5.9 | 7.2 | 55.6% | 1 | 37.07s | 642 | 18 | 80,864 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.1 | 3.1 | 66.7% | 1 | 25.15s | 471 | 79 | 632 | |
| Gemini 2.5 Flash | 4.8 | 10.0 | 0.0% | 0 | 4.86s | 486 | 92 | 1,899 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 15.36s | 627 | 63 | 1,622 | |
| Gemini 2.5 Flash | 9.8 | 10.0 | 100.0% | 0 | 2.62s | 615 | 69 | 1,203 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.2 | 7.2 | 88.9% | 1 | 26.11s | 594 | 196 | 1,767 | |
| Gemini 2.5 Flash | 7.7 | 10.0 | 66.7% | 0 | 3.18s | 558 | 126 | 2,499 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 74.73s | 8,079 | 228 | 542 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 6.20s | 5,088 | 234 | 1,140 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 54.46s | 183 | 8,516 | 8,531 | |
| Gemini 2.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 2.76s | 156 | 11 | 919 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 2.5 FlashmediumvsMuse Spark 1.3lowClaude Opus 4.6mediumvsDeepSeek V4 Flash 0423highGemini 2.5 FlashmediumvsMuse Spark 1.1lowSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highDeepSeek V4 Flash 0423highvsGLM 5mediumDeepSeek V4 Flash 0423highvsSolar Pro 4xhighDeepSeek V4 Flash 0423highvsNemotron 3 UltramediumKostenlos verfügbarClaude Opus 5nonevsDeepSeek V4 Flash 0423highDeepSeek V4.1 FlashmaxvsGemini 2.5 FlashmediumDeepSeek V4 Flash 0423highvsGPT-5.4 NanomediumClaude Opus 4.8lowvsDeepSeek V4 Flash 0423highSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423high