Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Qwen3.6 Plus Preview

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-04-04

Metrik Claude Sonnet 4.6 Claude Sonnet 4.6 medium Veröffentlichung: 2026-02-17 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Veröffentlichung: 2026-03-30
Punktzahl 7.9 8.5
Rang #25 #7
Konsistenz 9.5 10.0
Korrekte Tests
Erfolgsquote pro Versuch 72.6% 76.5%
Instabile Tests 1 0
Gesamtläufe 51 49
Kosten pro Ergebnis 8.531 0.000
Gesamtkosten $1.024 $0.000
Eingabepreis $3.000 / 1M $0.000 / 1M
Ausgabepreis $15.000 / 1M $0.000 / 1M
Ausgabe-Token 35,174 1,756
Denk-Token 24,687 77,213
Antwortzeit (Durchschnitt) 10.09s 13.94s
Antwortzeit (Maximum) 46.35s 43.55s
Antwortzeit (Gesamt) 90.85s 237.01s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 9.90s 207 7,557
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
Qwen3.6 Plus Preview 5.1 10.0 0.0% 0 27.05s 111 5,232
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.54s 102 5,552
Puzzle Solving Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 6.11s 298 6,868
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330

Schnellvergleich

Vergleichspaar wechseln