AI BENCHY
Advertise here
#11

Grok 4.6

X AI Veröffentlichung: 2026-08-12 Getestet am: 2026-08-12 23:02 x-ai/grok-4.6::high
~1.7T insgesamt (~170B aktiv)MoEGeschlossenGeschätzt
(high) (medium) (low)

Zusammenfassung

Grok 4.6 erreicht 9.2 bei AI BENCHY und liegt auf #11. Das Modell hat 10.0 Zuverlässigkeit, 84.9% Erfolgsrate, $1.809 Gesamtkosten und 79.38s durchschnittliche Antwortzeit.

Was Grok 4.6 besonders macht: Es nutzt ungewöhnlich viele Reasoning-Tokens, was langsamere oder teurere Läufe erklären kann.

Modelldaten

Recherchiert am 2026-08-12

Geschätzt
Parameter
~1.7T insgesamt (~170B aktiv)
Architektur
MoE
Verfügbarkeit
Geschlossen
Lizenz
-

Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.

Punktzahl

9.2

Konsistenz

9.6

Gesamte Ausgabe-Token

265,604

Gesamte Eingabe-Token

107,266

Eingabepreis

$2.000 / 1M

Ausgabepreis

$6.000 / 1M

Korrekte Tests

Falsche Tests: 4

Erfolgsquote pro Versuch: 84.9%

Instabile Tests

1

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

79.38s

Antwortzeit (Maximum): 618.49s

Antwortzeit (Gesamt): 1746.29s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 SpaceXAI: Grok 4.6

high
Kosten
$0.107
Zeit
265.1s
Token
18,001 tok

Preisverlauf

Historische Preisdaten für dieses Modell von OpenRouter.

Datum Eingabepreis Ausgabepreis
2026-08-12 23:12 $2.000 / 1M $6.000 / 1M

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 10.0 10.0
Programmierung 10.0 10.0
Kombiniert 10.0 10.0
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 3.6 7.2
Allgemeine Intelligenz 10.0 10.0
Befolgung von Anweisungen 9.8 10.0
Rätsellösen 10.0 10.0
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle