Zusammenfassung
Grok Build 0.1 erreicht 4.0 bei AI BENCHY und liegt auf #193. Das Modell hat 10.0 Zuverlässigkeit, 43.9% Erfolgsrate, $0.547 Gesamtkosten und 28.69s durchschnittliche Antwortzeit.
Was Grok Build 0.1 besonders macht: Am stärksten ist es in Domänenspezifisch, wo es #4 erreicht; am schwächsten ist Programmierung mit #18.
Archiviertes Modell: Dieses Modell wird nicht mehr aktualisiert und nicht mehr in neuen Tests getestet.
Modelldaten
Recherchiert am 2026-08-12
- Parameter
- ~300B insgesamt (~30B aktiv)
- Architektur
- MoE
- Verfügbarkeit
- Geschlossen
- Lizenz
- -
Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.
4.0
Konsistenz
7.2
10.0
Gesamte Ausgabe-Token
267,275
Gesamte Eingabe-Token
11,793
Eingabepreis
$1.000 / 1M
Ausgabepreis
$2.000 / 1M
Preis für Cache-Lesen
k. A.
Preis für Cache-Schreiben
k. A.
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Instabile Tests
4
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Testverlauf
| Getestet am | Punktzahl | Zuverlässigkeit | Korrekte Tests | Gesamtkosten | Vergleichen |
|---|---|---|---|---|---|
| 2026-05-21 12:40 Erneuter Test | 4.0 | 10.0 | $0.547 | Vergleichen | |
| 2026-05-21 12:40 Erneuter Test | 4.0 | 10.0 | $0.547 | Aktueller Lauf | |
| 2026-05-21 12:40 Erneuter Test | 6.0 | 10.0 | $0.547 | Vergleichen | |
| 2026-05-21 12:40 Erneuter Test | 6.6 | 10.0 | $0.547 | Vergleichen |
Laufvergleich
| Lauf | Benchmark-Abdeckung | Punktzahl | Konsistenz | Zuverlässigkeit | Korrekte Tests | Instabile Tests | Gesamte Ausgabe-Token | Gesamte Eingabe-Token | Gesamtkosten | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-05-21 12:40 · Erneuter Test | 57/57 Versuche | 4.0 | 7.2 | 10.0 | 7/19 | 4 | 267,275 | 11,793 | $0.547 | 28.69s |
| 2026-05-21 12:40 · Erneuter Test | 57/57 Versuche | 4.0 | 7.2 | 10.0 | 7/19 | 4 | 267,275 | 11,793 | $0.547 | 28.69s |
| Differenz | — | 0.0 | 0.0 | 0.0 | 0 | 0 | 0 | 0 | $0.000 | 0ms |
Preisverlauf
Historische Preisdaten für dieses Modell von OpenRouter.
| Datum | Eingabepreis | Ausgabepreis | Preis für Cache-Lesen | Preis für Cache-Schreiben |
|---|---|---|---|---|
| 2026-06-04 15:40 | $1.000 / 1M | $2.000 / 1M | k. A. | k. A. |
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Anti-KI-Tricks | 8.7 | 7.9 | |
| Programmierung | 3.3 | 3.3 | |
| Kombiniert | 1.5 | 5.0 | |
| Datenanalyse und -extraktion | 3.8 | 5.8 | |
| Domänenspezifisch | 3.6 | 7.2 | |
| Allgemeine Intelligenz | 4.3 | 10.0 | |
| Befolgung von Anweisungen | 9.8 | 10.0 | |
| Rätsellösen | 6.4 | 7.7 | |
| Werkzeugaufrufe | 3.0 | 10.0 | |
| Allgemeinwissen | 3.0 | 10.0 |