Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs Grok 4.20 Beta

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-04-26

Metrik Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Veröffentlichung: 2026-02-19 Grok 4.20 Beta Grok 4.20 Beta none Veröffentlichung: 2026-03-12
Punktzahl 9.6 5.3
Rang #2 #93
Zuverlässigkeit k. A. k. A.
Konsistenz 10.0 9.2
Korrekte Tests
Erfolgsquote pro Versuch 94.4% 29.6%
Instabile Tests 0 2
Gesamtläufe 54 52
Kosten pro Ergebnis 3.400 2.255
Gesamtkosten $0.578 $0.091
Eingabepreis $2.000 / 1M $0.000 / 1M
Ausgabepreis $12.000 / 1M $0.000 / 1M
Ausgabe-Token 1,932 1,591
Denk-Token 40,542 0
Antwortzeit (Durchschnitt) 15.96s 1.19s
Antwortzeit (Maximum) 40.61s 6.48s
Antwortzeit (Gesamt) 175.52s 21.37s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 251 0
Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 19.88s 405 4,201
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 74 0
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
Rätsellösen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

Schnellvergleich

Vergleichspaar wechseln