- Rang
- #162
- Gesamte Ausgabe-Token
- 63,967
- Antwortzeit (Durchschnitt)
- 6.27s
- Gesamtkosten
- $0.153
Gemini 3.1 Flash Lite (medium) vs Grok 4.6 (low)
Grok 4.6 (low) führt beim Durchschnittsscore mit 6.9 vs 6.9. Gemini 3.1 Flash Lite (medium) hat die niedrigeren Benchmark-Kosten mit $0.153 vs $0.781. Gemini 3.1 Flash Lite (medium) ist schneller mit 6.27s vs 16.44s, mit Erfolgsraten von 59.4% vs 66.7%.
Verglichene Modelle
- Rang
- #159
- Gesamte Ausgabe-Token
- 42,315
- Antwortzeit (Durchschnitt)
- 16.44s
- Gesamtkosten
- $0.781
Empfohlenes Modell
Gemini 3.1 Flash Lite (medium)
Die Punktzahl bleibt nah an der besten hier (6.9 vs 6.9) und es kostet etwa 5.1x weniger als Grok 4.6 (low).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium | Grok 4.6 Grok 4.6 low |
|---|---|---|
| Punktzahl | 6.9 | 6.9 |
| Rang | #162 | #159 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 59.4% | 66.7% |
| Instabile Tests | 2 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 1.177 | 5.205 |
| Gesamtkosten | $0.153 | $0.781 |
| Eingabepreis | $0.250 / 1M | $2.000 / 1M |
| Ausgabepreis | $1.500 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 228,023 | 263,427 |
| Ausgabe-Token | 10,779 | 6,006 |
| Denk-Token | 53,188 | 36,309 |
| Antwortzeit (Durchschnitt) | 6.27s | 16.44s |
| Antwortzeit (Maximum) | 47.78s | 57.97s |
| Antwortzeit (Gesamt) | 144.10s | 378.14s |
| Parameter | ~150B insgesamt (~10B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#162 Gemini 3.1 Flash Lite
medium- Kosten
- $0.003
- Zeit
- 5.3s
- Token
- 1,754 tok
#159 SpaceXAI: Grok 4.6
low- Kosten
- $0.011
- Zeit
- 26.0s
- Token
- 1,941 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 5.0 | 10.0 | 0.0% | 0 | 47.78s | 123,098 | 1,611 | 0 | |
| Grok 4.6 | 5.0 | 10.0 | 0.0% | 0 | 57.97s | 153,467 | 882 | 3,385 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 9.1 | 10.0 | 75.0% | 0 | 2.39s | 502 | 604 | 4,201 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 9.00s | 2,991 | 104 | 3,343 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 5.5 | 10.0 | 33.3% | 0 | 3.81s | 8,134 | 459 | 8,978 | |
| Grok 4.6 | 5.5 | 7.1 | 44.4% | 1 | 21.69s | 9,579 | 349 | 7,740 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 7.2 | 9.1 | 50.0% | 0 | 18.55s | 80,983 | 7,241 | 20,231 | |
| Grok 4.6 | 6.5 | 10.0 | 50.0% | 0 | 23.33s | 71,233 | 3,899 | 2,805 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.60s | 7,362 | 279 | 2,845 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 11.63s | 8,937 | 225 | 1,423 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 2.9 | 7.2 | 11.1% | 1 | 3.93s | 650 | 15 | 7,223 | |
| Grok 4.6 | 3.0 | 10.0 | 0.0% | 0 | 18.19s | 2,523 | 16 | 7,921 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.60s | 488 | 84 | 1,142 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 16.29s | 1,077 | 55 | 1,009 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 9.9 | 10.0 | 100.0% | 0 | 2.59s | 623 | 75 | 3,320 | |
| Grok 4.6 | 9.8 | 10.0 | 100.0% | 0 | 6.64s | 1,857 | 57 | 2,310 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 7.6 | 7.2 | 77.8% | 1 | 1.95s | 568 | 165 | 2,450 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 8.16s | 2,430 | 154 | 2,506 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 4.55s | 5,457 | 234 | 921 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 14.42s | 8,544 | 255 | 359 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 3.0 | 10.0 | 0.0% | 0 | 3.08s | 158 | 12 | 1,877 | |
| Grok 4.6 | 3.0 | 10.0 | 0.0% | 0 | 26.11s | 789 | 10 | 3,508 |
Schnellvergleich
Vergleichspaar wechseln
Qwen3.5-122B-A10BmediumvsGrok 4.6lowEmber-1highvsGemini 3.1 Flash LitemediumGemini 3.1 Flash LitemediumvsGPT-5.6 LunalowClaude Sonnet 5.5lowvsGemini 3.1 Flash LitemediumClaude Opus 4.8nonevsGemini 3.1 Flash LitemediumKimi K2.7 CodemediumvsGrok 4.6lowGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowGemini 3.1 Flash LitemediumvsMuse Glimmer 30BlowEmber-1highvsGrok 4.6lowGemini 3.1 Flash LitemediumvsInklinglowKostenlos verfügbarGPT-5.2 ChatnonevsGrok 4.6lowGemma 4 31BmediumKostenlos verfügbarvsGrok 4.6low