Navigation
AI BENCHY
Advertise here

North Mini Code (medium) vs KAT-Coder-Air V2.5 (high)

North Mini Code (medium) führt beim Durchschnittsscore mit 5.7 vs 5.6. North Mini Code (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.077. KAT-Coder-Air V2.5 (high) ist schneller mit 15.87s vs 141.99s, mit Erfolgsraten von 43.9% vs 42.4%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-15

Rang
#192
Gesamte Ausgabe-Token
1,764,791
Antwortzeit (Durchschnitt)
141.99s
Gesamtkosten
$0.000
Rang
#201
Gesamte Ausgabe-Token
114,654
Antwortzeit (Durchschnitt)
15.87s
Gesamtkosten
$0.077
Empfohlenes Modell KAT-Coder-Air V2.5 (high)

Die Punktzahl bleibt nah an der besten hier (5.6 vs 5.7) und es antwortet etwa 8.9x schneller als North Mini Code (medium).

Detaillierter Vergleich

Metrik North Mini Code North Mini Code medium Veröffentlichung: 2026-06-18 Kostenlos verfügbar KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 high Veröffentlichung: 2026-07-14
Punktzahl 5.7 5.6
Rang #192 #201
Zuverlässigkeit 8.5 9.8
Konsistenz 8.5 8.1
Versuche 58/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 43.9% 42.4%
Instabile Tests 4 5
Gesamtläufe 58 66
Kosten pro Ergebnis 0.000 1.091
Gesamtkosten $0.000 $0.077
Eingabepreis $0.000 / 1M $0.150 / 1M
Ausgabepreis $0.000 / 1M $0.600 / 1M
Gesamte Eingabe-Token 81,742 50,423
Ausgabe-Token 423,884 4,144
Denk-Token 1,340,907 110,510
Antwortzeit (Durchschnitt) 141.99s 15.87s
Antwortzeit (Maximum) 786.72s 118.35s
Antwortzeit (Gesamt) 3123.87s 349.16s
Parameter 30B insgesamt (3B aktiv) ~35B insgesamt (~3B aktiv)
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 North Mini Code

medium
Kosten
$0.000
Zeit
51.8s
Token
12,460 tok

#201 KAT-Coder-Air V2.5

high
Ungültiges SVG
Kosten
$0.000
Zeit
300.0s
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569
KAT-Coder-Air V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883

Schnellvergleich

Vergleichspaar wechseln