- Rang
- #241
- Gesamte Ausgabe-Token
- 153,595
- Antwortzeit (Durchschnitt)
- 14.13s
- Gesamtkosten
- $1.752
Gemini 3.5 Flash vs Mistral Large 4 (medium)
Der Durchschnittsscore ist mit 6.1 vs 6.2 praktisch gleichauf. Mistral Large 4 (medium) hat die niedrigeren Benchmark-Kosten mit $1.456 vs $1.752. Gemini 3.5 Flash ist schneller mit 14.13s vs 265.03s, mit Erfolgsraten von 68.1% vs 55.1%.
Verglichene Modelle
- Rang
- #240
- Gesamte Ausgabe-Token
- 627,233
- Antwortzeit (Durchschnitt)
- 265.03s
- Gesamtkosten
- $1.456
Empfohlenes Modell
Gemini 3.5 Flash
Es hat hier die beste Punktzahl (6.1) und antwortet etwa 18.8x schneller als Mistral Large 4 (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Gemini 3.5 Flash none | Mistral Large 4 Mistral Large 4 medium |
|---|---|---|
| Punktzahl | 6.1 | 6.2 |
| Rang | #241 | #240 |
| Zuverlässigkeit | 10.0 | 9.2 |
| Konsistenz | 8.6 | 7.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 68.1% | 55.1% |
| Instabile Tests | 4 | 7 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 12.511 | 16.168 |
| Gesamtkosten | $1.752 | $1.456 |
| Eingabepreis | $1.500 / 1M | $0.680 / 1M |
| Ausgabepreis | $9.000 / 1M | $2.090 / 1M |
| Preis für Cache-Lesen | $0.150 / 1M | $0.070 / 1M |
| Preis für Cache-Schreiben | $0.084 / 1M | k. A. |
| Gesamte Eingabe-Token | 246,061 | 212,024 |
| Ausgabe-Token | 3,828 | 166,422 |
| Denk-Token | 149,767 | 562,095 |
| Antwortzeit (Durchschnitt) | 14.13s | 265.03s |
| Antwortzeit (Maximum) | 85.26s | 1760.20s |
| Antwortzeit (Gesamt) | 268.55s | 6095.69s |
| Parameter | ~500B insgesamt (~20B aktiv) | 1.05T insgesamt (49B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#241 Gemini 3.5 Flash
none- Kosten
- $0.225
- Zeit
- 125.5s
- Token
- 25,004 tok
#240 Mistral Large 4
medium- Kosten
- $0.011
- Zeit
- 63.4s
- Token
- 5,291 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 2.8 | 1.6 | 33.3% | 1 | 85.26s | 232,209 | 2,528 | 31,967 | |
| Mistral Large 4 | 6.1 | 3.1 | 66.7% | 1 | 173.21s | 135,844 | 7,482 | 13,709 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.53s | 492 | 174 | 4,927 | |
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 15.73s | 705 | 1,087 | 7,308 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 8.8 | 7.8 | 88.9% | 1 | 34.69s | 8,122 | 456 | 75,471 | |
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1201.87s | 7,189 | 33,530 | 303,140 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Mistral Large 4 | 7.3 | 5.8 | 83.3% | 1 | 510.65s | 51,756 | 8,436 | 82,002 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 6.5 | 10.0 | 50.0% | 0 | 8.10s | 2,781 | 177 | 5,718 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 25.95s | 7,314 | 1,046 | 7,861 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 5.3 | 7.2 | 44.4% | 1 | 12.18s | 642 | 12 | 19,480 | |
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 288.04s | 798 | 85,691 | 114,373 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.46s | 486 | 120 | 1,500 | |
| Mistral Large 4 | 3.5 | 2.2 | 33.3% | 1 | 39.33s | 516 | 4,704 | 4,909 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 9.8 | 10.0 | 100.0% | 0 | 3.38s | 615 | 70 | 3,858 | |
| Mistral Large 4 | 8.3 | 10.0 | 50.0% | 0 | 24.62s | 708 | 6,709 | 7,691 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.13s | 558 | 279 | 4,361 | |
| Mistral Large 4 | 6.1 | 4.7 | 66.7% | 2 | 41.40s | 717 | 8,254 | 10,519 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 19.19s | 6,267 | 303 | 1,104 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 2.8 | 1.6 | 33.3% | 1 | 4.87s | 156 | 12 | 2,485 | |
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 84.68s | 210 | 9,180 | 9,479 |
Schnellvergleich
Vergleichspaar wechseln
Claude Fable 5.1lowvsMistral Large 4mediumTrinity Large ThinkingmediumvsGemini 3.5 FlashnoneGemini 3.1 Flash Lite PreviewnonevsMistral Large 4mediumApodex 1.1 MinilowKostenlos verfügbarvsGemini 3.5 FlashnoneDeepSeek V4 Flash 0731nonevsMistral Large 4mediumGemini 3.5 FlashnonevsGranite 4.2 8BmediumClaude Fable 5.1lowvsGemini 3.5 FlashnoneGemini 3.5 FlashnonevsKAT-Coder-Pro V2.5defaultApodex 1.1 MinilowKostenlos verfügbarvsMistral Large 4mediumMistral Large 4mediumvsInklingnoneKostenlos verfügbarMistral Large 4mediumvsQwen3.5 Plus 2026-04-20noneMistral Large 4mediumvsSpace Bunny Alphaxhigh