Navigation
AI BENCHY
Advertise here

North Mini Code vs Mercury 2.5 Preview (low)

North Mini Code führt beim Durchschnittsscore mit 5.1 vs 5.0. North Mini Code hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.011. Mercury 2.5 Preview (low) ist schneller mit 1.31s vs 29.95s, mit Erfolgsraten von 18.2% vs 47.0%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-09-02

Rang
#252
Gesamte Ausgabe-Token
26,786
Antwortzeit (Durchschnitt)
29.95s
Gesamtkosten
$0.000
Rang
#254
Gesamte Ausgabe-Token
31,975
Antwortzeit (Durchschnitt)
1.31s
Gesamtkosten
$0.011
Empfohlenes Modell Mercury 2.5 Preview (low)

Die Punktzahl bleibt nah an der besten hier (5.0 vs 5.1) und es antwortet etwa 22.9x schneller als North Mini Code.

Detaillierter Vergleich

Metrik North Mini Code North Mini Code none Veröffentlichung: 2026-06-18 Kostenlos verfügbar Mercury 2.5 Preview Mercury 2.5 Preview low Veröffentlichung: 2026-09-02
Punktzahl 5.1 5.0
Rang #252 #254
Zuverlässigkeit 8.7 10.0
Konsistenz 9.9 7.0
Versuche 60/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 18.2% 47.0%
Instabile Tests 0 8
Gesamtläufe 60 66
Kosten pro Ergebnis 0.000 0.169
Gesamtkosten $0.000 $0.011
Eingabepreis $0.000 / 1M $0.040 / 1M
Ausgabepreis $0.000 / 1M $0.150 / 1M
Gesamte Eingabe-Token 130,501 133,525
Ausgabe-Token 26,786 7,259
Denk-Token 0 24,716
Antwortzeit (Durchschnitt) 29.95s 1.31s
Antwortzeit (Maximum) 159.85s 7.29s
Antwortzeit (Gesamt) 658.83s 28.77s
Parameter 30B insgesamt (3B aktiv) ~100B
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#252 North Mini Code

none
Kosten
$0.000
Zeit
266.1s
Token
63,551 tok

#254 Mercury 2.5 Preview

low
Kosten
$0.001
Zeit
1.5s
Token
1,169 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
North Mini Code 3.9 10.0 0.0% 0 21.96s 7,119 504 0
Mercury 2.5 Preview 5.5 10.0 33.3% 0 972ms 7,794 695 2,263

Schnellvergleich

Vergleichspaar wechseln