Navigation
Advertise here

Claude Sonnet 5 vs Qwen3.8 Flash Next

Claude Sonnet 5 führt beim Durchschnittsscore mit 5.9 vs 5.8. Qwen3.8 Flash Next hat die niedrigeren Benchmark-Kosten mit ~$0.011 vs $1.095. Qwen3.8 Flash Next ist schneller mit 5.71s vs 8.60s, mit Erfolgsraten von 40.6% vs 43.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#255
Gesamte Ausgabe-Token
30,777
Antwortzeit (Durchschnitt)
8.60s
Gesamtkosten
$1.095
Rang
#258
Gesamte Ausgabe-Token
9,077
Antwortzeit (Durchschnitt)
5.71s
Gesamtkosten
~$0.011
Empfohlenes Modell Qwen3.8 Flash Next

Die Punktzahl bleibt nah an der besten hier (5.8 vs 5.9) und es kostet etwa 101.2x weniger als Claude Sonnet 5.

Detaillierter Vergleich

Metrik Claude Sonnet 5 Claude Sonnet 5 none Veröffentlichung: 2026-06-30 Qwen3.8 Flash Next Qwen3.8 Flash Next none Veröffentlichung: 2026-10-04
Punktzahl 5.9 5.8
Rang #255 #258
Zuverlässigkeit 10.0 10.0
Konsistenz 8.4 9.0
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 40.6% 43.5%
Instabile Tests 5 3
Gesamtläufe 69 69
Kosten pro Ergebnis 15.642 ~0.136
Gesamtkosten $1.095 ~$0.011
Eingabepreis $2.000 / 1M k. A.
Ausgabepreis $10.000 / 1M k. A.
Preis für Cache-Lesen $0.200 / 1M k. A.
Preis für Cache-Schreiben $2.500 / 1M k. A.
Gesamte Eingabe-Token 393,560 266,004
Ausgabe-Token 30,777 9,077
Denk-Token 0 0
Antwortzeit (Durchschnitt) 8.60s 5.71s
Antwortzeit (Maximum) 64.73s 65.25s
Antwortzeit (Gesamt) 197.73s 131.36s
Parameter ~1T insgesamt (~100B aktiv) 180B insgesamt (6B aktiv)
Verfügbarkeit Geschlossen Gewichte verfügbar

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#255 Claude Sonnet 5

none
Kosten
$0.061
Zeit
53.7s
Token
6,172 tok

#258 Qwen3.8 Flash Next

none
Kosten
~$0.001
Zeit
27.5s
Token
2,983 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Qwen3.8 Flash Next 5.5 10.0 33.3% 0 1.64s 7,911 669 0

Schnellvergleich

Vergleichspaar wechseln

Claude Sonnet 5nonevsgpt-oss-120bmediumClaude Sonnet 5nonevsGemini 3.1 Flash LiteminimalLing 3.0 FlashhighvsQwen3.8 Flash NextnoneClaude Sonnet 5nonevsInkling SmallmediumKostenlos verfügbargpt-oss-120bmediumvsQwen3.8 Flash NextnoneClaude Sonnet 5nonevsGLM 5.3 FlashXlowRing 2.6 1tmediumvsQwen3.8 Flash NextnoneTrinity Large ThinkinghighvsQwen3.8 Flash NextnoneGemini 3.1 Flash LiteminimalvsQwen3.8 Flash NextnoneGPT-5 NanomediumvsQwen3.8 Flash NextnoneClaude Sonnet 5nonevsLing 3.0 FlashhighQwen3.8 Flash NextnonevsInkling SmallmediumKostenlos verfügbar