Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

North Mini Code (medium) vs Qwen3.5-122B-A10B

North Mini Code (medium) führt beim Durchschnittsscore mit 5.9 vs 5.7. North Mini Code (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.283. Qwen3.5-122B-A10B ist schneller mit 12.92s vs 137.11s, mit Erfolgsraten von 48.5% vs 33.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-12

Rang
#183
Gesamte Ausgabe-Token
1,766,801
Antwortzeit (Durchschnitt)
137.11s
Gesamtkosten
$0.000
Rang
#192
Gesamte Ausgabe-Token
88,458
Antwortzeit (Durchschnitt)
12.92s
Gesamtkosten
$0.283
Empfohlenes Modell Qwen3.5-122B-A10B

Die Punktzahl bleibt nah an der besten hier (5.7 vs 5.9) und es antwortet etwa 10.6x schneller als North Mini Code (medium).

Detaillierter Vergleich

Metrik North Mini Code North Mini Code medium Veröffentlichung: 2026-06-18 Kostenlos verfügbar Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Veröffentlichung: 2026-02-24
Punktzahl 5.9 5.7
Rang #183 #192
Zuverlässigkeit 8.6 10.0
Konsistenz 8.5 9.3
Versuche 58/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 48.5% 33.3%
Instabile Tests 4 2
Gesamtläufe 58 66
Kosten pro Ergebnis 0.000 4.182
Gesamtkosten $0.000 $0.283
Eingabepreis $0.000 / 1M $0.290 / 1M
Ausgabepreis $0.000 / 1M $2.400 / 1M
Gesamte Eingabe-Token 81,813 241,566
Ausgabe-Token 424,772 88,458
Denk-Token 1,342,029 0
Antwortzeit (Durchschnitt) 137.11s 12.92s
Antwortzeit (Maximum) 786.72s 212.63s
Antwortzeit (Gesamt) 3016.42s 284.21s
Parameter 30B insgesamt (3B aktiv) 122B insgesamt (10B aktiv)
Verfügbarkeit Open Source Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 North Mini Code

medium
Kosten
$0.000
Zeit
51.8s
Token
12,460 tok

#192 Qwen3.5-122B-A10B

none
Kosten
$0.016
Zeit
44.5s
Token
6,431 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

Schnellvergleich

Vergleichspaar wechseln