- Rang
- #76
- Gesamte Ausgabe-Token
- 211,310
- Antwortzeit (Durchschnitt)
- 51.81s
- Gesamtkosten
- $0.042
DeepSeek V4 Flash 0423 (high) vs Gemini 3.1 Pro Preview (medium)
Gemini 3.1 Pro Preview (medium) führt beim Durchschnittsscore mit 9.2 vs 7.6. DeepSeek V4 Flash 0423 (high) hat die niedrigeren Benchmark-Kosten mit $0.042 vs $1.352. Gemini 3.1 Pro Preview (medium) ist schneller mit 20.62s vs 51.81s, mit Erfolgsraten von 69.7% vs 90.9%.
- Rang
- #12
- Gesamte Ausgabe-Token
- 97,238
- Antwortzeit (Durchschnitt)
- 20.62s
- Gesamtkosten
- $1.352
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Es hat hier die beste Punktzahl (9.2) und antwortet etwa 2.5x schneller als DeepSeek V4 Flash 0423 (high).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Punktzahl | 7.6 | 9.2 |
| Rang | #76 | #12 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.5 | 10.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 69.7% | 90.9% |
| Instabile Tests | 4 | 0 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.446 | 6.758 |
| Gesamtkosten | $0.042 | $1.352 |
| Eingabepreis | $0.089 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.178 / 1M | $12.000 / 1M |
| Gesamte Eingabe-Token | 108,480 | 92,296 |
| Ausgabe-Token | 37,229 | 5,232 |
| Denk-Token | 174,081 | 92,006 |
| Antwortzeit (Durchschnitt) | 51.81s | 20.62s |
| Antwortzeit (Maximum) | 218.13s | 88.68s |
| Antwortzeit (Gesamt) | 1139.75s | 329.94s |
| Parameter | 284B insgesamt (13B aktiv) | ~1.2T insgesamt (~20B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#76 DeepSeek V4 Flash 0423
high- Kosten
- $0.003
- Zeit
- 93.1s
- Token
- 7,926 tok
#12 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.3 | 10.0 | 75.0% | 0 | 28.51s | 540 | 140 | 7,770 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 7.8 | 10.0 | 66.7% | 0 | 50.60s | 7,279 | 395 | 34,862 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.4 | 5.8 | 66.7% | 1 | 104.10s | 82,663 | 4,633 | 37,533 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 28.03s | 7,290 | 201 | 1,179 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.6 | 7.2 | 22.2% | 1 | 115.42s | 754 | 22,778 | 79,643 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.1 | 3.1 | 66.7% | 1 | 25.15s | 471 | 79 | 632 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 15.36s | 627 | 63 | 1,622 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.2 | 7.2 | 88.9% | 1 | 26.11s | 594 | 196 | 1,767 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 74.73s | 8,079 | 228 | 542 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 54.46s | 183 | 8,516 | 8,531 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 5highvsGemini 3.1 Pro PreviewmediumClaude Opus 4.6mediumvsDeepSeek V4 Flash 0423highGemini 3.1 Pro PreviewmediumvsGrok 4.6highSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highDeepSeek V4 Flash 0423highvsGLM 5mediumDeepSeek V4 Flash 0423highvsSolar Pro 4xhighDeepSeek V4 Flash 0423highvsNemotron 3 UltramediumKostenlos verfügbarGemini 3.1 Pro PreviewmediumvsGPT-5.5lowClaude Opus 5nonevsDeepSeek V4 Flash 0423highGemini 3.1 Pro PreviewmediumvsGPT-5.6 SolhighDeepSeek V4 Flash 0423highvsGPT-5.4 NanomediumClaude Opus 4.8lowvsDeepSeek V4 Flash 0423high