Navigation
Advertise here

Claude Fable 5.1 (high) vs Qwen3.8 Flash Next (low)

Der Durchschnittsscore ist mit 7.9 vs 8.0 praktisch gleichauf. Qwen3.8 Flash Next (low) hat die niedrigeren Benchmark-Kosten mit ~$0.045 vs $3.471. Claude Fable 5.1 (high) ist schneller mit 13.30s vs 23.66s, mit Erfolgsraten von 85.5% vs 79.7%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#100
Gesamte Ausgabe-Token
40,466
Antwortzeit (Durchschnitt)
13.30s
Gesamtkosten
$3.471
Rang
#96
Gesamte Ausgabe-Token
135,295
Antwortzeit (Durchschnitt)
23.66s
Gesamtkosten
~$0.045
Empfohlenes Modell Qwen3.8 Flash Next (low)

Es hat hier die beste Punktzahl (8.0) und kostet etwa 77.4x weniger als Claude Fable 5.1 (high).

Detaillierter Vergleich

Metrik Claude Fable 5.1 Claude Fable 5.1 high Veröffentlichung: 2026-09-02 Qwen3.8 Flash Next Qwen3.8 Flash Next low Veröffentlichung: 2026-10-04
Punktzahl 7.9 8.0
Rang #100 #96
Zuverlässigkeit 10.0 10.0
Konsistenz 9.7 8.0
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 85.5% 79.7%
Instabile Tests 1 6
Gesamtläufe 69 69
Kosten pro Ergebnis 18.264 ~0.299
Gesamtkosten $3.471 ~$0.045
Eingabepreis $10.000 / 1M k. A.
Ausgabepreis $50.000 / 1M k. A.
Preis für Cache-Lesen $0.250 / 1M k. A.
Preis für Cache-Schreiben $12.500 / 1M k. A.
Gesamte Eingabe-Token 144,676 342,163
Ausgabe-Token 8,184 1,518
Denk-Token 32,282 133,777
Antwortzeit (Durchschnitt) 13.30s 23.66s
Antwortzeit (Maximum) 40.17s 166.72s
Antwortzeit (Gesamt) 305.83s 544.16s
Parameter ~9.5T insgesamt (~878B aktiv) 180B insgesamt (6B aktiv)
Verfügbarkeit Geschlossen Gewichte verfügbar

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 Claude Fable 5.1

high
Kosten
$0.384
Zeit
102.5s
Token
7,824 tok

#96 Qwen3.8 Flash Next

low
Kosten
~$0.002
Zeit
47.2s
Token
5,270 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

Schnellvergleich

Vergleichspaar wechseln

Claude Fable 5.1highvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsGPT-5.4 MinimediumClaude Fable 5.1highvsQwen3.5-27BmediumGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Fable 5.1highvsQwen3.7 MaxnoneClaude Fable 5.1highvsGPT-5.6 TerralowQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxNemotron 3 UltramediumKostenlos verfügbarvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowClaude Fable 5.1highvsGemini 3.8 Flashmedium