- Rang
- #90
- Gesamte Ausgabe-Token
- 57,778
- Antwortzeit (Durchschnitt)
- 4.59s
- Gesamtkosten
- $0.117
Gemini 3.1 Flash Lite Preview (medium) vs Grok Build 0.1 (medium)
Der Durchschnittsscore ist mit 7.4 vs 7.5 praktisch gleichauf. Gemini 3.1 Flash Lite Preview (medium) hat die niedrigeren Benchmark-Kosten mit $0.117 vs $1.130. Gemini 3.1 Flash Lite Preview (medium) ist schneller mit 4.59s vs 54.50s, mit Erfolgsraten von 63.6% vs 60.6%.
- Rang
- #89
- Gesamte Ausgabe-Token
- 511,406
- Antwortzeit (Durchschnitt)
- 54.50s
- Gesamtkosten
- $1.130
Empfohlenes Modell
Gemini 3.1 Flash Lite Preview (medium)
Es hat hier die beste Punktzahl (7.4) und kostet etwa 9.7x weniger als Grok Build 0.1 (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium | Grok Build 0.1 Grok Build 0.1 medium |
|---|---|---|
| Punktzahl | 7.4 | 7.5 |
| Rang | #90 | #89 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.9 | 9.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 63.6% | 60.6% |
| Instabile Tests | 0 | 1 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.829 | 8.691 |
| Gesamtkosten | $0.117 | $1.130 |
| Eingabepreis | $0.250 / 1M | $1.000 / 1M |
| Ausgabepreis | $1.500 / 1M | $2.000 / 1M |
| Gesamte Eingabe-Token | 117,493 | 106,946 |
| Ausgabe-Token | 10,589 | 7,993 |
| Denk-Token | 47,189 | 503,413 |
| Antwortzeit (Durchschnitt) | 4.59s | 54.50s |
| Antwortzeit (Maximum) | 18.34s | 252.69s |
| Antwortzeit (Gesamt) | 101.04s | 1199.07s |
| Parameter | ~150B insgesamt (~10B aktiv) | ~300B insgesamt (~30B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#90 Gemini 3.1 Flash Lite Preview
medium- Kosten
- $0.003
- Zeit
- 5.2s
- Token
- 1,944 tok
#89 SpaceXAI: Grok Build 0.1
medium- Kosten
- $0.028
- Zeit
- 81.3s
- Token
- 14,009 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 9.1 | 10.0 | 75.0% | 0 | 2.33s | 512 | 570 | 4,305 | |
| Grok Build 0.1 | 8.3 | 10.0 | 75.0% | 0 | 7.43s | 2,010 | 220 | 12,162 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 4.09s | 8,126 | 461 | 8,597 | |
| Grok Build 0.1 | 5.7 | 9.7 | 33.3% | 0 | 108.46s | 8,304 | 1,138 | 161,452 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 7.2 | 9.1 | 50.0% | 0 | 16.63s | 93,097 | 8,706 | 16,997 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 65.08s | 75,242 | 5,442 | 65,569 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 2.29s | 7,362 | 279 | 2,952 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 10.72s | 7,761 | 180 | 8,876 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.3 | 10.0 | 33.3% | 0 | 4.09s | 652 | 18 | 6,120 | |
| Grok Build 0.1 | 2.9 | 7.2 | 11.1% | 1 | 175.94s | 1,959 | 492 | 192,037 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.16s | 488 | 96 | 1,488 | |
| Grok Build 0.1 | 4.4 | 9.9 | 0.0% | 0 | 18.41s | 825 | 76 | 6,345 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.91s | 621 | 72 | 2,121 | |
| Grok Build 0.1 | 9.8 | 10.0 | 100.0% | 0 | 12.36s | 1,362 | 57 | 9,599 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 7.7 | 10.0 | 66.7% | 0 | 5.30s | 566 | 141 | 1,896 | |
| Grok Build 0.1 | 7.7 | 10.0 | 66.7% | 0 | 18.26s | 1,689 | 195 | 20,841 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.80s | 5,909 | 234 | 912 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 13.12s | 7,263 | 180 | 4,969 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 160 | 12 | 1,801 | |
| Grok Build 0.1 | 3.0 | 10.0 | 0.0% | 0 | 53.51s | 531 | 13 | 21,563 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.1 Flash Lite PreviewmediumvsQwen3.7 MaxnoneQwen3.7 MaxnonevsGrok Build 0.1mediumGPT 5.3 ChatnonevsGrok Build 0.1mediumGPT-5.6 TerralowvsGrok Build 0.1mediumGemini 3.1 Flash Lite PreviewmediumvsGPT 5.3 ChatnoneGemini 3.1 Flash Lite PreviewmediumvsGPT-5.6 TerralowGemini 3.1 Flash Lite PreviewmediumvsQwen3.8 2.4T A95BhighQwen3.8 2.4T A95BhighvsGrok Build 0.1mediumGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsGrok Build 0.1mediumClaude Opus 5nonevsGrok Build 0.1mediumSolar Pro 4xhighvsGrok Build 0.1medium