- Rang
- #215
- Gesamte Ausgabe-Token
- 39,912
- Antwortzeit (Durchschnitt)
- 4.79s
- Gesamtkosten
- $0.183
Gemini 3.5 Flash Lite (low) vs Grok 4.20 (medium)
Gemini 3.5 Flash Lite (low) führt beim Durchschnittsscore mit 6.3 vs 6.3. Gemini 3.5 Flash Lite (low) hat die niedrigeren Benchmark-Kosten mit $0.183 vs $1.582. Gemini 3.5 Flash Lite (low) ist schneller mit 4.79s vs 36.73s, mit Erfolgsraten von 66.7% vs 58.0%.
Verglichene Modelle
- Rang
- #224
- Gesamte Ausgabe-Token
- 302,087
- Antwortzeit (Durchschnitt)
- 36.73s
- Gesamtkosten
- $1.582
Empfohlenes Modell
Gemini 3.5 Flash Lite (low)
Es hat hier die beste Punktzahl (6.3) und kostet etwa 8.7x weniger als Grok 4.20 (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite low | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Punktzahl | 6.3 | 6.3 |
| Rang | #215 | #224 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 7.9 | 8.2 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 66.7% | 58.0% |
| Instabile Tests | 6 | 5 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 1.521 | 14.374 |
| Gesamtkosten | $0.183 | $1.582 |
| Eingabepreis | $0.300 / 1M | $1.250 / 1M |
| Ausgabepreis | $2.500 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 275,779 | 392,127 |
| Ausgabe-Token | 14,401 | 7,754 |
| Denk-Token | 25,511 | 294,333 |
| Antwortzeit (Durchschnitt) | 4.79s | 36.73s |
| Antwortzeit (Maximum) | 53.91s | 199.66s |
| Antwortzeit (Gesamt) | 110.24s | 844.68s |
| Parameter | ~150B insgesamt (~10B aktiv) | ~1T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#215 Gemini 3.5 Flash Lite
low- Kosten
- $0.007
- Zeit
- 7.5s
- Token
- 2,669 tok
#224 SpaceXAI: Grok 4.20
medium- Kosten
- $0.041
- Zeit
- 110.3s
- Token
- 16,336 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 5.0 | 10.0 | 0.0% | 0 | 53.91s | 136,614 | 1,502 | 0 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 128.32s | 289,141 | 1,894 | 29,934 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 9.0 | 8.3 | 91.7% | 1 | 1.69s | 506 | 351 | 4,032 | |
| Grok 4.20 | 8.2 | 7.9 | 83.3% | 1 | 3.95s | 2,010 | 287 | 8,312 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 4.3 | 10.0 | 0.0% | 0 | 917ms | 8,126 | 464 | 0 | |
| Grok 4.20 | 6.3 | 6.6 | 55.6% | 1 | 109.93s | 8,307 | 268 | 103,150 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 3.8 | 1.6 | 50.0% | 2 | 11.00s | 114,540 | 11,142 | 9,298 | |
| Grok 4.20 | 8.7 | 6.9 | 83.3% | 1 | 42.25s | 71,267 | 3,776 | 44,009 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 859ms | 7,364 | 287 | 0 | |
| Grok 4.20 | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 7,761 | 180 | 5,333 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 5.9 | 7.2 | 55.6% | 1 | 3.55s | 658 | 18 | 6,902 | |
| Grok 4.20 | 2.9 | 7.2 | 11.1% | 1 | 49.71s | 1,959 | 872 | 59,761 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.34s | 488 | 97 | 1,049 | |
| Grok 4.20 | 3.9 | 2.6 | 33.3% | 1 | 24.48s | 825 | 65 | 6,440 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 9.8 | 10.0 | 100.0% | 0 | 1.75s | 621 | 70 | 1,872 | |
| Grok 4.20 | 9.8 | 10.0 | 100.0% | 0 | 4.26s | 1,362 | 57 | 6,419 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 7.6 | 7.2 | 77.8% | 1 | 1.19s | 572 | 168 | 1,494 | |
| Grok 4.20 | 7.7 | 10.0 | 66.7% | 0 | 6.22s | 1,689 | 149 | 7,913 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 1.39s | 6,132 | 293 | 0 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 13.68s | 7,275 | 197 | 6,620 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 4.7 | 1.6 | 66.7% | 1 | 1.65s | 158 | 9 | 864 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 63.48s | 531 | 9 | 16,442 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0423nonevsGrok 4.20mediumGemini 3.5 FlashnonevsGrok 4.20mediumGemini 3.5 Flash LitelowvsQwen3.6 27BnoneGemini 3.5 Flash LitelowvsQwen3.5-35B-A3BmediumGemini 3.5 Flash LitelowvsQwen3.5 Plus 2026-04-20noneGemini 3.5 Flash LitelowvsLongCat 2.0noneGemini 3.5 Flash LitelowvsSolar Pro 4highSpace Bunny AlphaxhighvsGrok 4.20mediumDots 3 Note PreviewhighKostenlos verfügbarvsGemini 3.5 Flash LitelowGemini 3.5 Flash LitelowvsSpace Bunny AlphamediumGemini 3.5 Flash LitelowvsMiMo-V2.5-PromediumDeepSeek V3.2mediumvsGemini 3.5 Flash Litelow