Advertise here
#362

Grok 4.20

X AI Veröffentlichung: 2026-03-31 Getestet am: 2026-05-06 14:16 x-ai/grok-4.20::none
~1T insgesamt (~100B aktiv)MoEGeschlossenGeschätzt
(medium) (none)

Zusammenfassung

Grok 4.20 erreicht 3.4 bei AI BENCHY und liegt auf #362. Das Modell hat k. A. Zuverlässigkeit, 26.1% Erfolgsrate, $0.057 Gesamtkosten und 1.11s durchschnittliche Antwortzeit.

Was Grok 4.20 besonders macht: Die Benchmark-Gesamtkosten sind für diese Leistungsklasse ungewöhnlich niedrig. Es ist im Vergleich zu ähnlichen Modellen auffällig schnell.

Identitätshinweis

Grok 4.20 Beta war die Vorschauversion von Grok 4.20.

Modelldaten

Recherchiert am 2026-08-12

Geschätzt
Parameter
~1T insgesamt (~100B aktiv)
Architektur
MoE
Verfügbarkeit
Geschlossen
Lizenz
-

Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.

Punktzahl

3.4

Konsistenz

7.8

Zuverlässigkeit

k. A.

Gesamtkosten (aktueller Preis)

$0.057 ↓ -40.1%

Getestet zu: $0.095

Gesamte Ausgabe-Token

1,923

Gesamte Eingabe-Token

41,313

Eingabepreis

$1.250 / 1M

Ausgabepreis

$2.500 / 1M

Preis für Cache-Lesen

$0.200 / 1M

Preis für Cache-Schreiben

k. A.

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Korrekte Tests

Falsche Tests: 12

Erfolgsquote pro Versuch: 26.1%

Benchmark-Abdeckung: 54/69 Versuche (Ziel: 3 Wiederholungen pro Test)

Instabile Tests

0

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

1.11s

Antwortzeit (Maximum): 6.04s

Antwortzeit (Gesamt): 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#362 xAI: Grok 4.20

none
Kosten
$0.004
Zeit
6.5s
Token
1,367 tok

Testverlauf

Getestet am Punktzahl Zuverlässigkeit Korrekte Tests Gesamtkosten Vergleichen
2026-05-06 14:16 Erneuter Test 3.4 k. A. $0.057 ↓ Aktueller Lauf
2026-05-06 14:16 Erneuter Test 4.1 k. A. $0.057 ↓ Vergleichen
2026-05-06 14:16 Erneuter Test 5.4 k. A. $0.057 ↓ Vergleichen
2026-05-06 14:16 Erneuter Test 5.4 k. A. $0.095 Vergleichen
2026-05-06 14:16 Erneuter Test 5.4 k. A. $0.095 Vergleichen
2026-05-06 14:16 Suite geändert 5.4 k. A. $0.095 Vergleichen
2026-04-11 01:44 Erster erfasster Lauf 5.2 k. A. $0.095 Vergleichen

Preisverlauf

Historische Preisdaten für dieses Modell von OpenRouter.

Datum Eingabepreis Ausgabepreis Preis für Cache-Lesen Preis für Cache-Schreiben
2026-06-04 15:40 $1.250 / 1M $2.500 / 1M k. A. k. A.
2026-10-01 18:33 $1.250 / 1M $2.500 / 1M $0.200 / 1M k. A.

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Agentenaufgaben 0.0 0.0
Anti-KI-Tricks 4.8 10.0
Programmierung 1.1 3.1
Kombiniert 1.5 5.0
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 3.0 10.0
Allgemeine Intelligenz 4.8 10.0
Befolgung von Anweisungen 6.3 10.0
Rätsellösen 5.3 10.0
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 0.0 0.0

Verglichene Modelle