- Rang
- #237
- Gesamte Ausgabe-Token
- 39,789
- Antwortzeit (Durchschnitt)
- 27.42s
- Gesamtkosten
- $0.053
DeepSeek V4 Flash 0731 vs Mistral Large 4 (medium)
Der Durchschnittsscore ist mit 6.2 vs 6.2 praktisch gleichauf. DeepSeek V4 Flash 0731 hat die niedrigeren Benchmark-Kosten mit $0.053 vs $1.456. DeepSeek V4 Flash 0731 ist schneller mit 27.42s vs 265.03s, mit Erfolgsraten von 30.4% vs 55.1%.
Verglichene Modelle
- Rang
- #240
- Gesamte Ausgabe-Token
- 627,233
- Antwortzeit (Durchschnitt)
- 265.03s
- Gesamtkosten
- $1.456
Empfohlenes Modell
DeepSeek V4 Flash 0731
Es hat hier die beste Punktzahl (6.2) und kostet etwa 27.7x weniger als Mistral Large 4 (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none | Mistral Large 4 Mistral Large 4 medium |
|---|---|---|
| Punktzahl | 6.2 | 6.2 |
| Rang | #237 | #240 |
| Zuverlässigkeit | 10.0 | 9.2 |
| Konsistenz | 8.7 | 7.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 30.4% | 55.1% |
| Instabile Tests | 4 | 7 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.826 | 16.168 |
| Gesamtkosten | $0.053 | $1.456 |
| Eingabepreis | $0.005 / 1M | $0.680 / 1M |
| Ausgabepreis | $1.280 / 1M | $2.090 / 1M |
| Preis für Cache-Lesen | $0.005 / 1M | $0.070 / 1M |
| Preis für Cache-Schreiben | k. A. | k. A. |
| Gesamte Eingabe-Token | 349,876 | 212,024 |
| Ausgabe-Token | 39,789 | 166,422 |
| Denk-Token | 0 | 562,095 |
| Antwortzeit (Durchschnitt) | 27.42s | 265.03s |
| Antwortzeit (Maximum) | 387.15s | 1760.20s |
| Antwortzeit (Gesamt) | 630.70s | 6095.69s |
| Parameter | 284B insgesamt (13B aktiv) | 1.05T insgesamt (49B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#237 DeepSeek V4 Flash 0731
none- Kosten
- $0.004
- Zeit
- 198.4s
- Token
- 14,316 tok
#240 Mistral Large 4
medium- Kosten
- $0.011
- Zeit
- 63.4s
- Token
- 5,291 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 174.89s | 255,310 | 14,363 | 0 | |
| Mistral Large 4 | 6.1 | 3.1 | 66.7% | 1 | 173.21s | 135,844 | 7,482 | 13,709 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.4 | 8.3 | 8.3% | 1 | 4.19s | 540 | 801 | 0 | |
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 15.73s | 705 | 1,087 | 7,308 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 4.3 | 10.0 | 0.0% | 0 | 1.72s | 7,275 | 505 | 0 | |
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1201.87s | 7,189 | 33,530 | 303,140 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.7 | 1.8 | 50.0% | 2 | 202.44s | 65,531 | 22,822 | 0 | |
| Mistral Large 4 | 7.3 | 5.8 | 83.3% | 1 | 510.65s | 51,756 | 8,436 | 82,002 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 2.37s | 7,290 | 199 | 0 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 25.95s | 7,314 | 1,046 | 7,861 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 5.3 | 10.0 | 33.3% | 0 | 1.17s | 675 | 26 | 0 | |
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 288.04s | 798 | 85,691 | 114,373 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 4.4 | 9.9 | 0.0% | 0 | 3.22s | 471 | 153 | 0 | |
| Mistral Large 4 | 3.5 | 2.2 | 33.3% | 1 | 39.33s | 516 | 4,704 | 4,909 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 5.0 | 6.8 | 33.3% | 1 | 1.42s | 627 | 69 | 0 | |
| Mistral Large 4 | 8.3 | 10.0 | 50.0% | 0 | 24.62s | 708 | 6,709 | 7,691 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.2 | 9.9 | 0.0% | 0 | 2.74s | 594 | 302 | 0 | |
| Mistral Large 4 | 6.1 | 4.7 | 66.7% | 2 | 41.40s | 717 | 8,254 | 10,519 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.5 | 10.0 | 100.0% | 0 | 4.61s | 11,380 | 536 | 0 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 19.19s | 6,267 | 303 | 1,104 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 1.85s | 183 | 13 | 0 | |
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 84.68s | 210 | 9,180 | 9,479 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0731nonevsKAT-Coder-Pro V2.5mediumClaude Fable 5.1lowvsMistral Large 4mediumDeepSeek V4 Flash 0731nonevsSpace Bunny AlphaxhighClaude Fable 5.1lowvsDeepSeek V4 Flash 0731noneGemini 3.5 FlashnonevsMistral Large 4mediumGemini 3.1 Flash Lite PreviewnonevsMistral Large 4mediumDeepSeek V4 Flash 0731nonevsGrok 4.20mediumApodex 1.1 MinilowKostenlos verfügbarvsMistral Large 4mediumMistral Large 4mediumvsInklingnoneKostenlos verfügbarMistral Large 4mediumvsQwen3.5 Plus 2026-04-20noneMistral Large 4mediumvsSpace Bunny AlphaxhighTrinity Large ThinkinglowvsDeepSeek V4 Flash 0731none