- Rang
- #39
- Gesamte Ausgabe-Token
- 727,349
- Antwortzeit (Durchschnitt)
- 83.04s
- Gesamtkosten
- $7.545
Claude Sonnet 5.5 (max) vs Qwen3.8 Max (0902) (high)
Claude Sonnet 5.5 (max) führt beim Durchschnittsscore mit 9.0 vs 8.9. Qwen3.8 Max (0902) (high) hat die niedrigeren Benchmark-Kosten mit $2.736 vs $7.545. Claude Sonnet 5.5 (max) ist schneller mit 83.04s vs 185.56s, mit Erfolgsraten von 81.8% vs 86.4%.
Verglichene Modelle
- Rang
- #42
- Gesamte Ausgabe-Token
- 419,443
- Antwortzeit (Durchschnitt)
- 185.56s
- Gesamtkosten
- $2.736
Empfohlenes Modell
Qwen3.8 Max (0902) (high)
Die Punktzahl bleibt nah an der besten hier (8.9 vs 9.0) und es kostet etwa 2.8x weniger als Claude Sonnet 5.5 (max).
Detaillierter Vergleich
| Metrik | Claude Sonnet 5.5 Claude Sonnet 5.5 max | Qwen3.8 Max (0902) Qwen3.8 Max (0902) high |
|---|---|---|
| Punktzahl | 9.0 | 8.9 |
| Rang | #39 | #42 |
| Zuverlässigkeit | 10.0 | 9.8 |
| Konsistenz | 9.4 | 9.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 81.8% | 86.4% |
| Instabile Tests | 2 | 3 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 44.380 | 16.089 |
| Gesamtkosten | $7.545 | $2.736 |
| Eingabepreis | $2.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $10.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 135,496 | 109,226 |
| Ausgabe-Token | 8,153 | 6,890 |
| Denk-Token | 719,196 | 412,553 |
| Antwortzeit (Durchschnitt) | 83.04s | 185.56s |
| Antwortzeit (Maximum) | 488.39s | 912.78s |
| Antwortzeit (Gesamt) | 1826.84s | 4082.41s |
| Parameter | ~1T insgesamt (~100B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#39 Claude Sonnet 5.5
max
OpenRouter returned no showcase content (finish_reason: length).
- Kosten
- $0.000
- Zeit
- 571.7s
- Token
- 0 tok
#42 Qwen3.8 Max (0902)
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 600.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.39s | 858 | 397 | 3,109 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 15.86s | 1,128 | 263 | 6,631 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.26s | 10,608 | 580 | 70,730 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 253.22s | 8,235 | 418 | 91,734 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 113.57s | 97,957 | 5,219 | 95,067 | |
| Qwen3.8 Max (0902) | 8.7 | 6.9 | 83.3% | 1 | 110.39s | 79,527 | 5,215 | 28,102 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.07s | 10,515 | 312 | 10,487 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 16.37s | 8,010 | 261 | 3,598 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 5.3 | 10.0 | 33.3% | 0 | 401.38s | 990 | 19 | 485,043 | |
| Qwen3.8 Max (0902) | 5.9 | 7.2 | 55.6% | 1 | 658.46s | 842 | 31 | 154,450 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 5.1 | 3.4 | 33.3% | 1 | 56.66s | 714 | 322 | 20,156 | |
| Qwen3.8 Max (0902) | 6.5 | 3.4 | 66.7% | 1 | 75.11s | 630 | 80 | 8,110 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 8.5 | 6.8 | 83.3% | 1 | 6.24s | 921 | 98 | 2,263 | |
| Qwen3.8 Max (0902) | 9.8 | 10.0 | 100.0% | 0 | 7.55s | 927 | 86 | 1,823 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.17s | 912 | 578 | 3,186 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 134.14s | 1,038 | 268 | 47,351 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 41.40s | 11,757 | 354 | 12,232 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.21s | 8,571 | 249 | 243 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 3.0 | 10.0 | 0.0% | 0 | 47.01s | 264 | 274 | 16,923 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 532.59s | 318 | 19 | 70,511 |
Schnellvergleich
Vergleichspaar wechseln
Claude Sonnet 5.5maxvsQwen3.8 MaxmediumClaude Sonnet 5.5maxvsGPT-5.5mediumGPT-5.3-CodexmediumvsQwen3.8 Max (0902)highClaude Sonnet 5.5maxvsGemini 3.5 FlashmediumClaude Sonnet 5.5maxvsGrok 4.5highQwen3.8 Max (0902)highvsParetononeGPT-5.5mediumvsQwen3.8 Max (0902)highClaude Sonnet 5.5maxvsGPT-5.3-CodexmediumClaude Sonnet 5.5maxvsQwen3.7 MaxmediumGemini 3.5 FlashmediumvsQwen3.8 Max (0902)highClaude Sonnet 5.5maxvsMuse Spark 1.3highClaude Opus 5.5mediumvsQwen3.8 Max (0902)high