- Rang
- #70
- Gesamte Ausgabe-Token
- 919,699
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $0.509
Claude Haiku 5.5 (max) vs Qwen3.8 Max (0902) (low)
Qwen3.8 Max (0902) (low) führt beim Durchschnittsscore mit 8.6 vs 8.5. Claude Haiku 5.5 (max) hat die niedrigeren Benchmark-Kosten mit $0.509 vs $1.131. Qwen3.8 Max (0902) (low) ist schneller mit 29.07s vs 61.71s, mit Erfolgsraten von 85.5% vs 85.5%.
Verglichene Modelle
- Rang
- #65
- Gesamte Ausgabe-Token
- 88,923
- Antwortzeit (Durchschnitt)
- 29.07s
- Gesamtkosten
- $1.131
Empfohlenes Modell
Claude Haiku 5.5 (max)
Die Punktzahl bleibt nah an der besten hier (8.5 vs 8.6) und es kostet etwa 2.2x weniger als Qwen3.8 Max (0902) (low).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 max | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Punktzahl | 8.5 | 8.6 |
| Rang | #70 | #65 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 85.5% | 85.5% |
| Instabile Tests | 1 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.677 | 6.283 |
| Gesamtkosten | $0.509 | $1.131 |
| Eingabepreis | $0.100 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.500 / 1M | $6.000 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.250 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 487,516 | 298,682 |
| Ausgabe-Token | 10,212 | 8,374 |
| Denk-Token | 909,487 | 80,549 |
| Antwortzeit (Durchschnitt) | 61.71s | 29.07s |
| Antwortzeit (Maximum) | 288.94s | 207.79s |
| Antwortzeit (Gesamt) | 1419.40s | 668.66s |
| Parameter | ~50B | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Kosten
- $0.000
- Zeit
- 164.5s
- Token
- 0 tok
#65 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Zeit
- 41.2s
- Token
- 2,421 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 136.04s | 194,728 | 2,052 | 11,006 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Schnellvergleich
Vergleichspaar wechseln
Claude Haiku 5.5maxvsQwen3.7 MaxmediumClaude Haiku 5.5maxvsMuse Spark 1.3lowQwen3.8 Max (0902)lowvsGrok 4.6highClaude Sonnet 5.5highvsQwen3.8 Max (0902)lowClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowClaude Sonnet 5mediumvsQwen3.8 Max (0902)lowDeepSeek V4.1 FlashmaxvsQwen3.8 Max (0902)lowClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5maxvsInklinghighKostenlos verfügbar