Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Air V2.5 vs Nemotron 3.5 Lightning (low)

Nemotron 3.5 Lightning (low) führt beim Durchschnittsscore mit 4.8 vs 4.8. KAT-Coder-Air V2.5 hat die niedrigeren Benchmark-Kosten mit $0.067 vs $0.173. KAT-Coder-Air V2.5 ist schneller mit 12.17s vs 59.45s, mit Erfolgsraten von 37.9% vs 42.4%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-11

Rang
#229
Gesamte Ausgabe-Token
93,913
Antwortzeit (Durchschnitt)
12.17s
Gesamtkosten
$0.067
Rang
#225
Gesamte Ausgabe-Token
653,448
Antwortzeit (Durchschnitt)
59.45s
Gesamtkosten
$0.173
Empfohlenes Modell KAT-Coder-Air V2.5

Die Punktzahl bleibt nah an der besten hier (4.8 vs 4.8) und es kostet etwa 2.6x weniger als Nemotron 3.5 Lightning (low).

Detaillierter Vergleich

Metrik KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 none Veröffentlichung: 2026-07-14 Nemotron 3.5 Lightning Nemotron 3.5 Lightning low Veröffentlichung: 2026-08-11 Kostenlos verfügbar
Punktzahl 4.8 4.8
Rang #229 #225
Zuverlässigkeit 10.0 9.8
Konsistenz 6.9 6.8
Benchmark-Abdeckung 22/22 Tests · 66/66 Versuche 22/22 Tests · 66/66 Versuche
Korrekte Tests
Erfolgsquote pro Versuch 37.9% 42.4%
Instabile Tests 8 9
Gesamtläufe 66 66
Kosten pro Ergebnis 1.336 0.000
Gesamtkosten $0.067 $0.173
Eingabepreis $0.150 / 1M $0.100 / 1M
Ausgabepreis $0.600 / 1M $0.250 / 1M
Gesamte Eingabe-Token 69,367 138,783
Ausgabe-Token 93,913 137,292
Denk-Token 0 516,156
Antwortzeit (Durchschnitt) 12.17s 59.45s
Antwortzeit (Maximum) 121.05s 312.21s
Antwortzeit (Gesamt) 267.83s 1307.87s

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#229 KAT-Coder-Air V2.5

none
Kosten
$0.002
Zeit
14.5s
Token
2,619 tok

#225 Nemotron 3.5 Lightning

low
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
Kosten
$0.000
Zeit
-
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
KAT-Coder-Air V2.5 3.3 9.6 0.0% 0 14.31s 6,472 16,918 0
Nemotron 3.5 Lightning 4.0 7.8 11.1% 1 224.42s 7,522 72,614 262,558

Schnellvergleich

Vergleichspaar wechseln