Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kev 4B (default) vs Decider V1.1 27B (default)

Decider V1.1 27B (default) führt beim Durchschnittsscore mit 2.6 vs 2.4. Decider V1.1 27B (default) hat die niedrigeren Benchmark-Kosten mit $0.002 vs $0.002. Decider V1.1 27B (default) ist schneller mit 320ms vs 5.63s, mit Erfolgsraten von 15.9% vs 17.4%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#397
Gesamte Ausgabe-Token
28,061
Antwortzeit (Durchschnitt)
5.63s
Gesamtkosten
$0.002
Rang
#395
Gesamte Ausgabe-Token
69
Antwortzeit (Durchschnitt)
320ms
Gesamtkosten
$0.002
Empfohlenes Modell Decider V1.1 27B (default)

Es hat hier die beste Punktzahl (2.6) und antwortet etwa 17.6x schneller als Kev 4B (default).

Detaillierter Vergleich

Metrik Kev 4B Kev 4B default Veröffentlichung: 2026-09-28 Decider V1.1 27B Decider V1.1 27B default Veröffentlichung: 2026-10-07
Punktzahl 2.4 2.6
Rang #397 #395
Zuverlässigkeit 10.0 10.0
Konsistenz 4.9 5.2
Versuche 36/69 36/69
Korrekte Tests
Erfolgsquote pro Versuch 15.9% 17.4%
Instabile Tests 1 0
Gesamtläufe 36 36
Kosten pro Ergebnis 0.060 0.037
Gesamtkosten $0.002 $0.002
Eingabepreis $0.042 / 1M $0.020 / 1M
Ausgabepreis $0.000 / 1M $0.000 / 1M
Preis für Cache-Lesen k. A. k. A.
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 42,804 73,557
Ausgabe-Token 28,061 69
Denk-Token 0 0
Antwortzeit (Durchschnitt) 5.63s 320ms
Antwortzeit (Maximum) 17.79s 491ms
Antwortzeit (Gesamt) 67.61s 3.84s
Parameter 4B 27B
Verfügbarkeit Open Source Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Vergleichspaar wechseln

Command A+lowvsDecider V1.1 27BdefaultCommand A+nonevsDecider V1.1 27BdefaultCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultCommand A+highvsDecider V1.1 27BdefaultGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+highvsKev 4BdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20noneCommand A+mediumvsKev 4BdefaultKev 4BdefaultvsGrok 4.20none