Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed 2.1 Turbo vs GPT-5 Nano (medium)

GPT-5 Nano (medium) führt beim Durchschnittsscore mit 6.0 vs 5.9. Seed 2.1 Turbo hat die niedrigeren Benchmark-Kosten mit $0.092 vs $0.118. Seed 2.1 Turbo ist schneller mit 6.84s vs 54.20s, mit Erfolgsraten von 54.6% vs 54.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-15

Rang
#192
Gesamte Ausgabe-Token
10,643
Antwortzeit (Durchschnitt)
6.84s
Gesamtkosten
$0.092
Rang
#184
Gesamte Ausgabe-Token
282,437
Antwortzeit (Durchschnitt)
54.20s
Gesamtkosten
$0.118
Empfohlenes Modell Seed 2.1 Turbo

Die Punktzahl bleibt nah an der besten hier (5.9 vs 6.0) und es antwortet etwa 7.9x schneller als GPT-5 Nano (medium).

Detaillierter Vergleich

Metrik Seed 2.1 Turbo Seed 2.1 Turbo none Veröffentlichung: 2026-08-12 GPT-5 Nano GPT-5 Nano medium Veröffentlichung: 2025-08-07
Punktzahl 5.9 6.0
Rang #192 #184
Zuverlässigkeit 10.0 10.0
Konsistenz 8.9 6.6
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 54.6% 54.5%
Instabile Tests 3 9
Gesamtläufe 66 66
Kosten pro Ergebnis 0.912 1.472
Gesamtkosten $0.092 $0.118
Eingabepreis $0.500 / 1M $0.050 / 1M
Ausgabepreis $2.500 / 1M $0.400 / 1M
Gesamte Eingabe-Token 129,150 94,944
Ausgabe-Token 10,643 12,037
Denk-Token 0 270,400
Antwortzeit (Durchschnitt) 6.84s 54.20s
Antwortzeit (Maximum) 55.92s 227.89s
Antwortzeit (Gesamt) 150.46s 867.23s
Parameter ~200B insgesamt (~20B aktiv) ~120B insgesamt (~5B aktiv)
Verfügbarkeit Geschlossen Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 Seed 2.1 Turbo

none
Kosten
$0.093
Zeit
517.1s
Token
37,102 tok

#184 GPT-5 Nano

medium
Kosten
$0.006
Zeit
108.5s
Token
13,209 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Seed 2.1 Turbo 4.5 7.9 22.2% 1 2.35s 8,211 608 0
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

Schnellvergleich

Vergleichspaar wechseln