Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

North Mini Code (medium) vs GPT-5.4

North Mini Code (medium) führt beim Durchschnittsscore mit 5.9 vs 5.8. North Mini Code (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.397. GPT-5.4 ist schneller mit 2.07s vs 137.11s, mit Erfolgsraten von 48.5% vs 34.9%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-11

Rang
#172
Gesamte Ausgabe-Token
1,766,801
Antwortzeit (Durchschnitt)
137.11s
Gesamtkosten
$0.000
Rang
#174
Gesamte Ausgabe-Token
8,321
Antwortzeit (Durchschnitt)
2.07s
Gesamtkosten
$0.397
Empfohlenes Modell GPT-5.4

Die Punktzahl bleibt nah an der besten hier (5.8 vs 5.9) und es antwortet etwa 66.3x schneller als North Mini Code (medium).

Detaillierter Vergleich

Metrik North Mini Code North Mini Code medium Veröffentlichung: 2026-06-18 Kostenlos verfügbar GPT-5.4 GPT-5.4 none Veröffentlichung: 2026-03-05
Punktzahl 5.9 5.8
Rang #172 #174
Zuverlässigkeit 8.6 10.0
Konsistenz 8.5 9.2
Benchmark-Abdeckung 22/22 Tests · 58/66 Versuche 22/22 Tests · 66/66 Versuche
Korrekte Tests
Erfolgsquote pro Versuch 48.5% 34.9%
Instabile Tests 4 2
Gesamtläufe 58 66
Kosten pro Ergebnis 0.000 5.663
Gesamtkosten $0.000 $0.397
Eingabepreis $0.000 / 1M $2.500 / 1M
Ausgabepreis $0.000 / 1M $15.000 / 1M
Gesamte Eingabe-Token 81,813 108,632
Ausgabe-Token 424,772 8,321
Denk-Token 1,342,029 0
Antwortzeit (Durchschnitt) 137.11s 2.07s
Antwortzeit (Maximum) 786.72s 15.63s
Antwortzeit (Gesamt) 3016.42s 45.51s

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 North Mini Code

medium
Kosten
$0.000
Zeit
51.8s
Token
12,460 tok

#174 GPT-5.4

none
Kosten
$0.026
Zeit
18.1s
Token
1,792 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0

Schnellvergleich

Vergleichspaar wechseln