Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (low) vs DeepSeek V4 Flash 0731

Der Durchschnittsscore ist mit 6.2 vs 6.2 praktisch gleichauf. DeepSeek V4 Flash 0731 hat die niedrigeren Benchmark-Kosten mit $0.055 vs $3.395. Claude Fable 5.1 (low) ist schneller mit 11.40s vs 27.42s, mit Erfolgsraten von 55.1% vs 30.4%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#231
Gesamte Ausgabe-Token
26,073
Antwortzeit (Durchschnitt)
11.40s
Gesamtkosten
$3.395
Rang
#229
Gesamte Ausgabe-Token
39,789
Antwortzeit (Durchschnitt)
27.42s
Gesamtkosten
$0.055
Empfohlenes Modell Claude Fable 5.1 (low)

Es hat hier die beste Punktzahl (6.2) und antwortet etwa 2.4x schneller als DeepSeek V4 Flash 0731.

Detaillierter Vergleich

Metrik Claude Fable 5.1 Claude Fable 5.1 low Veröffentlichung: 2026-09-02 DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none Veröffentlichung: 2026-08-01
Punktzahl 6.2 6.2
Rang #231 #229
Zuverlässigkeit 10.0 10.0
Konsistenz 8.9 8.7
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 55.1% 30.4%
Instabile Tests 3 4
Gesamtläufe 69 69
Kosten pro Ergebnis 30.862 0.826
Gesamtkosten $3.395 $0.055
Eingabepreis $10.000 / 1M $0.010 / 1M
Ausgabepreis $50.000 / 1M $1.280 / 1M
Gesamte Eingabe-Token 209,116 349,876
Ausgabe-Token 10,031 39,789
Denk-Token 16,042 0
Antwortzeit (Durchschnitt) 11.40s 27.42s
Antwortzeit (Maximum) 34.77s 387.15s
Antwortzeit (Gesamt) 262.14s 630.70s
Parameter ~9.5T insgesamt (~878B aktiv) 284B insgesamt (13B aktiv)
Verfügbarkeit Geschlossen Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#231 Claude Fable 5.1

low
Kosten
$0.126
Zeit
28.5s
Token
2,652 tok

#229 DeepSeek V4 Flash 0731

none
Kosten
$0.004
Zeit
198.4s
Token
14,316 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
DeepSeek V4 Flash 0731 4.3 10.0 0.0% 0 1.72s 7,275 505 0

Schnellvergleich

Vergleichspaar wechseln