AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#366

Kev 4B

Jaredpalmer Veröffentlichung: 2026-09-28 Getestet am: 2026-09-28 08:07 jaredpalmer/kev-4b::none
4BDichtOpen SourceGeschätzt

Zusammenfassung

Kev 4B erreicht 3.0 bei AI BENCHY und liegt auf #366. Das Modell hat 10.0 Zuverlässigkeit, 16.7% Erfolgsrate, $0.002 Gesamtkosten und 5.63s durchschnittliche Antwortzeit.

Was Kev 4B besonders macht: Die Benchmark-Gesamtkosten sind für diese Leistungsklasse ungewöhnlich niedrig. Es ist im Vergleich zu ähnlichen Modellen auffällig schnell.

Modelldaten

Recherchiert am 2026-09-28

Geschätzt
Parameter
4B
Architektur
Dicht
Verfügbarkeit
Open Source
Lizenz
Apache-2.0

Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.

Punktzahl

3.0

Konsistenz

5.1

Gesamte Ausgabe-Token

28,061

Gesamte Eingabe-Token

42,804

Eingabepreis

$0.042 / 1M

Ausgabepreis

$0.000 / 1M

Korrekte Tests

Falsche Tests: 9

Erfolgsquote pro Versuch: 16.7%

Benchmark-Abdeckung: 36/66 Versuche. Adapter liefern die Auswahlmöglichkeiten. Unterstützt 12/22 Tests. Andere Tests werden nicht unterstützt und gelten nicht als fehlgeschlagen. Die Bewertung nutzt die gesamte Testsuite.

Instabile Tests

1

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

5.63s

Antwortzeit (Maximum): 17.79s

Antwortzeit (Gesamt): 67.61s

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 2.3 7.5
Programmierung 4.5 6.7
Kombiniert 0.0 0.0
Datenanalyse und -extraktion 6.5 10.0
Domänenspezifisch 5.3 10.0
Allgemeine Intelligenz 0.0 0.0
Befolgung von Anweisungen 1.5 5.0
Rätsellösen 2.0 10.0
Werkzeugaufrufe 0.0 0.0
Allgemeinwissen 0.0 0.0

Verglichene Modelle