- Rang
- #216
- Gesamte Ausgabe-Token
- 438,891
- Antwortzeit (Durchschnitt)
- 19.04s
- Gesamtkosten
- $0.736
Gemini 3.1 Flash Lite Preview (low) vs Grok 4.20 (medium)
Gemini 3.1 Flash Lite Preview (low) führt beim Durchschnittsscore mit 6.3 vs 6.3. Gemini 3.1 Flash Lite Preview (low) hat die niedrigeren Benchmark-Kosten mit $0.736 vs $1.582. Gemini 3.1 Flash Lite Preview (low) ist schneller mit 19.04s vs 36.73s, mit Erfolgsraten von 60.9% vs 58.0%.
Verglichene Modelle
- Rang
- #224
- Gesamte Ausgabe-Token
- 302,087
- Antwortzeit (Durchschnitt)
- 36.73s
- Gesamtkosten
- $1.582
Empfohlenes Modell
Gemini 3.1 Flash Lite Preview (low)
Es hat hier die beste Punktzahl (6.3) und kostet etwa 2.1x weniger als Grok 4.20 (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Punktzahl | 6.3 | 6.3 |
| Rang | #216 | #224 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 10.0 | 8.2 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 60.9% | 58.0% |
| Instabile Tests | 0 | 5 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 5.256 | 14.374 |
| Gesamtkosten | $0.736 | $1.582 |
| Eingabepreis | $0.250 / 1M | $1.250 / 1M |
| Ausgabepreis | $1.500 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 309,715 | 392,127 |
| Ausgabe-Token | 16,170 | 7,754 |
| Denk-Token | 422,721 | 294,333 |
| Antwortzeit (Durchschnitt) | 19.04s | 36.73s |
| Antwortzeit (Maximum) | 309.35s | 199.66s |
| Antwortzeit (Gesamt) | 437.98s | 844.68s |
| Parameter | ~150B insgesamt (~10B aktiv) | ~1T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#216 Gemini 3.1 Flash Lite Preview
low- Kosten
- $0.002
- Zeit
- 3.7s
- Token
- 1,203 tok
#224 SpaceXAI: Grok 4.20
medium- Kosten
- $0.041
- Zeit
- 110.3s
- Token
- 16,336 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.0 | 10.0 | 0.0% | 0 | 71.29s | 199,519 | 1,453 | 25,259 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 128.32s | 289,141 | 1,894 | 29,934 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 8.3 | 10.0 | 75.0% | 0 | 2.12s | 506 | 462 | 1,638 | |
| Grok 4.20 | 8.2 | 7.9 | 83.3% | 1 | 3.95s | 2,010 | 287 | 8,312 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 1.39s | 8,138 | 660 | 1,060 | |
| Grok 4.20 | 6.3 | 6.6 | 55.6% | 1 | 109.93s | 8,307 | 268 | 103,150 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 160.63s | 85,851 | 12,656 | 389,079 | |
| Grok 4.20 | 8.7 | 6.9 | 83.3% | 1 | 42.25s | 71,267 | 3,776 | 44,009 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.00s | 7,455 | 291 | 696 | |
| Grok 4.20 | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 7,761 | 180 | 5,333 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 7.7 | 10.0 | 66.7% | 0 | 2.10s | 652 | 18 | 1,191 | |
| Grok 4.20 | 2.9 | 7.2 | 11.1% | 1 | 49.71s | 1,959 | 872 | 59,761 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 4.0 | 10.0 | 0.0% | 0 | 1.54s | 490 | 69 | 384 | |
| Grok 4.20 | 3.9 | 2.6 | 33.3% | 1 | 24.48s | 825 | 65 | 6,440 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.49s | 621 | 72 | 753 | |
| Grok 4.20 | 9.8 | 10.0 | 100.0% | 0 | 4.26s | 1,362 | 57 | 6,419 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.69s | 566 | 243 | 1,248 | |
| Grok 4.20 | 7.7 | 10.0 | 66.7% | 0 | 6.22s | 1,689 | 149 | 7,913 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 9.54s | 5,757 | 237 | 993 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 13.68s | 7,275 | 197 | 6,620 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 1.35s | 160 | 9 | 420 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 63.48s | 531 | 9 | 16,442 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0423nonevsGrok 4.20mediumGemini 3.5 FlashnonevsGrok 4.20mediumGemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-04-20noneGemini 3.1 Flash Lite PreviewlowvsQwen3.6 27BnoneGemini 3.1 Flash Lite PreviewlowvsSolar Pro 4highGemini 3.1 Flash Lite PreviewlowvsQwen3.5-35B-A3BmediumGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0noneSpace Bunny AlphaxhighvsGrok 4.20mediumGemini 3.1 Flash Lite PreviewlowvsSpace Bunny AlphamediumDots 3 Note PreviewhighKostenlos verfügbarvsGemini 3.1 Flash Lite PreviewlowDeepSeek V3.2mediumvsGemini 3.1 Flash Lite PreviewlowSolar Pro 4highvsGrok 4.20medium