- Rang
- #97
- Gesamte Ausgabe-Token
- 211,310
- Antwortzeit (Durchschnitt)
- 51.81s
- Gesamtkosten
- $0.042
DeepSeek V4 Flash 0423 (high) vs Grok Build 0.1 (medium)
DeepSeek V4 Flash 0423 (high) führt beim Durchschnittsscore mit 7.6 vs 7.5. DeepSeek V4 Flash 0423 (high) hat die niedrigeren Benchmark-Kosten mit $0.042 vs $1.130. DeepSeek V4 Flash 0423 (high) ist schneller mit 51.81s vs 54.50s, mit Erfolgsraten von 69.7% vs 60.6%.
Verglichene Modelle
- Rang
- #111
- Gesamte Ausgabe-Token
- 511,406
- Antwortzeit (Durchschnitt)
- 54.50s
- Gesamtkosten
- $1.130
Empfohlenes Modell
DeepSeek V4 Flash 0423 (high)
Es hat hier die beste Punktzahl (7.6) und kostet etwa 27.2x weniger als Grok Build 0.1 (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high | Grok Build 0.1 Grok Build 0.1 medium |
|---|---|---|
| Punktzahl | 7.6 | 7.5 |
| Rang | #97 | #111 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.5 | 9.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 69.7% | 60.6% |
| Instabile Tests | 4 | 1 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.446 | 8.691 |
| Gesamtkosten | $0.042 | $1.130 |
| Eingabepreis | $0.089 / 1M | $1.000 / 1M |
| Ausgabepreis | $0.178 / 1M | $2.000 / 1M |
| Gesamte Eingabe-Token | 108,480 | 106,946 |
| Ausgabe-Token | 37,229 | 7,993 |
| Denk-Token | 174,081 | 503,413 |
| Antwortzeit (Durchschnitt) | 51.81s | 54.50s |
| Antwortzeit (Maximum) | 218.13s | 252.69s |
| Antwortzeit (Gesamt) | 1139.75s | 1199.07s |
| Parameter | 284B insgesamt (13B aktiv) | ~300B insgesamt (~30B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#97 DeepSeek V4 Flash 0423
high- Kosten
- $0.003
- Zeit
- 93.1s
- Token
- 7,926 tok
#111 SpaceXAI: Grok Build 0.1
medium- Kosten
- $0.028
- Zeit
- 81.3s
- Token
- 14,009 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.3 | 10.0 | 75.0% | 0 | 28.51s | 540 | 140 | 7,770 | |
| Grok Build 0.1 | 8.3 | 10.0 | 75.0% | 0 | 7.43s | 2,010 | 220 | 12,162 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 7.8 | 10.0 | 66.7% | 0 | 50.60s | 7,279 | 395 | 34,862 | |
| Grok Build 0.1 | 5.7 | 9.7 | 33.3% | 0 | 108.46s | 8,304 | 1,138 | 161,452 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.4 | 5.8 | 66.7% | 1 | 104.10s | 82,663 | 4,633 | 37,533 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 65.08s | 75,242 | 5,442 | 65,569 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 28.03s | 7,290 | 201 | 1,179 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 10.72s | 7,761 | 180 | 8,876 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.6 | 7.2 | 22.2% | 1 | 115.42s | 754 | 22,778 | 79,643 | |
| Grok Build 0.1 | 2.9 | 7.2 | 11.1% | 1 | 175.94s | 1,959 | 492 | 192,037 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 6.1 | 3.1 | 66.7% | 1 | 25.15s | 471 | 79 | 632 | |
| Grok Build 0.1 | 4.4 | 9.9 | 0.0% | 0 | 18.41s | 825 | 76 | 6,345 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 15.36s | 627 | 63 | 1,622 | |
| Grok Build 0.1 | 9.8 | 10.0 | 100.0% | 0 | 12.36s | 1,362 | 57 | 9,599 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 8.2 | 7.2 | 88.9% | 1 | 26.11s | 594 | 196 | 1,767 | |
| Grok Build 0.1 | 7.7 | 10.0 | 66.7% | 0 | 18.26s | 1,689 | 195 | 20,841 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 74.73s | 8,079 | 228 | 542 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 13.12s | 7,263 | 180 | 4,969 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 54.46s | 183 | 8,516 | 8,531 | |
| Grok Build 0.1 | 3.0 | 10.0 | 0.0% | 0 | 53.51s | 531 | 13 | 21,563 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.8 FlashlowvsGrok Build 0.1mediumQwen3.7 MaxnonevsGrok Build 0.1mediumGPT 5.3 ChatnonevsGrok Build 0.1mediumGPT-5.6 TerralowvsGrok Build 0.1mediumClaude Opus 4.6mediumvsDeepSeek V4 Flash 0423highQwen3.8 2.4T A95BhighvsGrok Build 0.1mediumGemini 3 Flash PreviewlowvsGrok Build 0.1mediumSeed-2.0-CodelowvsDeepSeek V4 Flash 0423highDeepSeek V4 Flash 0423highvsGLM 5mediumDeepSeek V4 Flash 0423highvsSolar Pro 4xhighDeepSeek V4 Flash 0423highvsNemotron 3 UltramediumKostenlos verfügbarClaude Opus 5nonevsGrok Build 0.1medium