- Rang
- #22
- Gesamte Ausgabe-Token
- 97,238
- Antwortzeit (Durchschnitt)
- 20.62s
- Gesamtkosten
- $1.352
Gemini 3.1 Pro Preview (medium) vs Grok 4.6 (high)
Grok 4.6 (high) führt beim Durchschnittsscore mit 9.3 vs 9.2. Gemini 3.1 Pro Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.352 vs $1.908. Gemini 3.1 Pro Preview (medium) ist schneller mit 20.62s vs 84.15s, mit Erfolgsraten von 90.9% vs 86.4%.
Verglichene Modelle
- Rang
- #19
- Gesamte Ausgabe-Token
- 282,217
- Antwortzeit (Durchschnitt)
- 84.15s
- Gesamtkosten
- $1.908
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Die Punktzahl bleibt nah an der besten hier (9.2 vs 9.3) und es antwortet etwa 4.1x schneller als Grok 4.6 (high).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium | Grok 4.6 Grok 4.6 high |
|---|---|---|
| Punktzahl | 9.2 | 9.3 |
| Rang | #22 | #19 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 10.0 | 10.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 90.9% | 86.4% |
| Instabile Tests | 0 | 0 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 6.758 | 10.042 |
| Gesamtkosten | $1.352 | $1.908 |
| Eingabepreis | $2.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $12.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 92,296 | 107,275 |
| Ausgabe-Token | 5,232 | 5,094 |
| Denk-Token | 92,006 | 277,123 |
| Antwortzeit (Durchschnitt) | 20.62s | 84.15s |
| Antwortzeit (Maximum) | 88.68s | 618.49s |
| Antwortzeit (Gesamt) | 329.94s | 1851.26s |
| Parameter | ~1.2T insgesamt (~20B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#22 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
#19 SpaceXAI: Grok 4.6
high- Kosten
- $0.107
- Zeit
- 265.1s
- Token
- 18,001 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 14.44s | 2,991 | 79 | 6,805 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 102.20s | 9,579 | 379 | 51,829 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 91.77s | 68,548 | 3,931 | 34,529 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 16.08s | 8,937 | 225 | 6,590 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 | |
| Grok 4.6 | 5.3 | 10.0 | 33.3% | 0 | 369.95s | 2,523 | 14 | 154,471 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 19.51s | 1,077 | 56 | 2,448 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 | |
| Grok 4.6 | 9.8 | 10.0 | 100.0% | 0 | 13.82s | 1,857 | 57 | 4,318 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 15.56s | 2,430 | 122 | 5,706 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 13.30s | 8,544 | 216 | 1,505 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 | |
| Grok 4.6 | 3.0 | 10.0 | 0.0% | 0 | 54.22s | 789 | 15 | 8,922 |
Schnellvergleich
Vergleichspaar wechseln
GPT-5.5lowvsGrok 4.6highClaude Opus 5.5highvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5lowvsGrok 4.6highGPT-6 AstramediumvsGrok 4.6highClaude Opus 5highvsGemini 3.1 Pro PreviewmediumGPT-5.6 SolmediumvsGrok 4.6highGPT-6 SolmediumvsGrok 4.6highClaude Opus 5.5lowvsGemini 3.1 Pro PreviewmediumGemini 3.7 FlashmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowGemini 3.7 FlashlowvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.6 Solhigh