Navigation
Advertise here

Dots 3 Note Preview (medium) vs GPT-5.4

Dots 3 Note Preview (medium) führt beim Durchschnittsscore mit 5.7 vs 5.6. Dots 3 Note Preview (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.690. GPT-5.4 ist schneller mit 3.89s vs 70.32s, mit Erfolgsraten von 58.0% vs 33.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#257
Gesamte Ausgabe-Token
710,627
Antwortzeit (Durchschnitt)
70.32s
Gesamtkosten
$0.000
Rang
#260
Gesamte Ausgabe-Token
9,372
Antwortzeit (Durchschnitt)
3.89s
Gesamtkosten
$0.690
Empfohlenes Modell GPT-5.4

Die Punktzahl bleibt nah an der besten hier (5.6 vs 5.7) und es antwortet etwa 18.1x schneller als Dots 3 Note Preview (medium).

Detaillierter Vergleich

Metrik Dots 3 Note Preview Dots 3 Note Preview medium Veröffentlichung: 2026-08-14 Kostenlos verfügbar GPT-5.4 GPT-5.4 none Veröffentlichung: 2026-03-05
Punktzahl 5.7 5.6
Rang #257 #260
Zuverlässigkeit 10.0 10.0
Konsistenz 6.9 9.3
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 58.0% 33.3%
Instabile Tests 9 2
Gesamtläufe 69 69
Kosten pro Ergebnis 0.000 9.845
Gesamtkosten $0.000 $0.690
Eingabepreis $0.000 / 1M $2.500 / 1M
Ausgabepreis $0.000 / 1M $15.000 / 1M
Gesamte Eingabe-Token 208,598 219,404
Ausgabe-Token 120,583 9,372
Denk-Token 590,044 0
Antwortzeit (Durchschnitt) 70.32s 3.89s
Antwortzeit (Maximum) 459.19s 43.73s
Antwortzeit (Gesamt) 1617.43s 89.48s
Parameter 280B insgesamt (16B aktiv) ~1.5T insgesamt (~100B aktiv)
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#257 Dots 3 Note Preview

medium
Kosten
$0.000
Zeit
585.4s
Token
12,198 tok

#260 GPT-5.4

none
Kosten
$0.026
Zeit
18.1s
Token
1,792 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Dots 3 Note Preview 4.2 5.1 33.3% 2 309.15s 7,368 29,392 373,137
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0

Schnellvergleich

Vergleichspaar wechseln