Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed 2.1 Turbo vs North Mini Code (medium)

North Mini Code (medium) führt beim Durchschnittsscore mit 5.9 vs 5.7. North Mini Code (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.092. Seed 2.1 Turbo ist schneller mit 6.85s vs 137.11s, mit Erfolgsraten von 50.0% vs 48.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-12

Rang
#187
Gesamte Ausgabe-Token
10,640
Antwortzeit (Durchschnitt)
6.85s
Gesamtkosten
$0.092
Rang
#183
Gesamte Ausgabe-Token
1,766,801
Antwortzeit (Durchschnitt)
137.11s
Gesamtkosten
$0.000
Empfohlenes Modell Seed 2.1 Turbo

Die Punktzahl bleibt nah an der besten hier (5.7 vs 5.9) und es antwortet etwa 20.0x schneller als North Mini Code (medium).

Detaillierter Vergleich

Metrik Seed 2.1 Turbo Seed 2.1 Turbo none Veröffentlichung: 2026-08-12 North Mini Code North Mini Code medium Veröffentlichung: 2026-06-18 Kostenlos verfügbar
Punktzahl 5.7 5.9
Rang #187 #183
Zuverlässigkeit 10.0 8.6
Konsistenz 8.9 8.5
Versuche 66/66 58/66
Korrekte Tests
Erfolgsquote pro Versuch 50.0% 48.5%
Instabile Tests 3 4
Gesamtläufe 66 58
Kosten pro Ergebnis 1.014 0.000
Gesamtkosten $0.092 $0.000
Eingabepreis $0.500 / 1M $0.000 / 1M
Ausgabepreis $2.500 / 1M $0.000 / 1M
Gesamte Eingabe-Token 129,141 81,813
Ausgabe-Token 10,640 424,772
Denk-Token 0 1,342,029
Antwortzeit (Durchschnitt) 6.85s 137.11s
Antwortzeit (Maximum) 55.92s 786.72s
Antwortzeit (Gesamt) 150.66s 3016.42s
Parameter ~200B insgesamt (~20B aktiv) 30B insgesamt (3B aktiv)
Verfügbarkeit Geschlossen Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Seed 2.1 Turbo

none
Kosten
$0.093
Zeit
517.1s
Token
37,102 tok

#183 North Mini Code

medium
Kosten
$0.000
Zeit
51.8s
Token
12,460 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Seed 2.1 Turbo 4.5 7.9 22.2% 1 2.35s 8,211 608 0
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569

Schnellvergleich

Vergleichspaar wechseln