- Rang
- #391
- Gesamte Ausgabe-Token
- 28,061
- Antwortzeit (Durchschnitt)
- 5.63s
- Gesamtkosten
- $0.002
Kev 4B (default) vs Grok 4.20
Grok 4.20 führt beim Durchschnittsscore mit 3.4 vs 2.4. Kev 4B (default) hat die niedrigeren Benchmark-Kosten mit $0.002 vs $0.057. Grok 4.20 ist schneller mit 1.11s vs 5.63s, mit Erfolgsraten von 15.9% vs 26.1%.
Verglichene Modelle
- Rang
- #376
- Gesamte Ausgabe-Token
- 1,923
- Antwortzeit (Durchschnitt)
- 1.11s
- Gesamtkosten
- $0.057
Empfohlenes Modell
Grok 4.20
Es hat hier die beste Punktzahl (3.4) und antwortet etwa 5.1x schneller als Kev 4B (default).
Detaillierter Vergleich
| Metrik | Kev 4B Kev 4B default | Grok 4.20 Grok 4.20 none |
|---|---|---|
| Punktzahl | 2.4 | 3.4 |
| Rang | #391 | #376 |
| Zuverlässigkeit | 10.0 | k. A. |
| Konsistenz | 4.9 | 7.8 |
| Versuche | 36/69 | 54/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 15.9% | 26.1% |
| Instabile Tests | 1 | 0 |
| Gesamtläufe | 36 | 54 |
| Kosten pro Ergebnis | 0.060 | 1.570 |
| Gesamtkosten | $0.002 | $0.057 |
| Eingabepreis | $0.042 / 1M | $1.250 / 1M |
| Ausgabepreis | $0.000 / 1M | $2.500 / 1M |
| Preis für Cache-Lesen | k. A. | $0.200 / 1M |
| Preis für Cache-Schreiben | k. A. | k. A. |
| Gesamte Eingabe-Token | 42,804 | 41,313 |
| Ausgabe-Token | 28,061 | 1,923 |
| Denk-Token | 0 | 0 |
| Antwortzeit (Durchschnitt) | 5.63s | 1.11s |
| Antwortzeit (Maximum) | 17.79s | 6.04s |
| Antwortzeit (Gesamt) | 67.61s | 19.96s |
| Parameter | 4B | ~1T insgesamt (~100B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#391 Jared Palmer: Kev 4B
default
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
- Kosten
- k. A.
- Zeit
- -
- Token
- 0 tok
#376 xAI: Grok 4.20
none- Kosten
- $0.004
- Zeit
- 6.5s
- Token
- 1,367 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultQwen3.5-9BmediumvsGrok 4.20none