- Rang
- #40
- Gesamte Ausgabe-Token
- 17,992
- Antwortzeit (Durchschnitt)
- 6.99s
- Gesamtkosten
- $1.121
Claude Opus 5 (low) vs Qwen3.6 Max Preview (medium)
Claude Opus 5 (low) führt beim Durchschnittsscore mit 8.7 vs 8.6. Claude Opus 5 (low) hat die niedrigeren Benchmark-Kosten mit $1.121 vs $1.132. Claude Opus 5 (low) ist schneller mit 6.99s vs 66.52s, mit Erfolgsraten von 83.3% vs 83.3%.
Verglichene Modelle
- Rang
- #48
- Gesamte Ausgabe-Token
- 170,373
- Antwortzeit (Durchschnitt)
- 66.52s
- Gesamtkosten
- $1.132
Empfohlenes Modell
Claude Opus 5 (low)
Es hat hier die beste Punktzahl (8.7) und antwortet etwa 9.5x schneller als Qwen3.6 Max Preview (medium).
Detaillierter Vergleich
| Metrik | Claude Opus 5 Claude Opus 5 low | Qwen3.6 Max Preview Qwen3.6 Max Preview medium |
|---|---|---|
| Punktzahl | 8.7 | 8.6 |
| Rang | #40 | #48 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 83.3% |
| Instabile Tests | 1 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 6.223 | 7.653 |
| Gesamtkosten | $1.121 | $1.132 |
| Eingabepreis | $5.000 / 1M | $1.028 / 1M |
| Ausgabepreis | $25.000 / 1M | $6.162 / 1M |
| Gesamte Eingabe-Token | 134,770 | 79,249 |
| Ausgabe-Token | 13,604 | 5,097 |
| Denk-Token | 4,388 | 165,276 |
| Antwortzeit (Durchschnitt) | 6.99s | 66.52s |
| Antwortzeit (Maximum) | 30.67s | 238.07s |
| Antwortzeit (Gesamt) | 153.80s | 1463.50s |
| Parameter | ~5T insgesamt (~500B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#40 Claude Opus 5
low- Kosten
- $0.062
- Zeit
- 30.2s
- Token
- 2,615 tok
#48 Qwen3.6 Max Preview
medium- Kosten
- $0.024
- Zeit
- 76.5s
- Token
- 3,861 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 834 | 1,008 | 376 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 7.8 | 7.4 | 77.8% | 1 | 6.70s | 10,590 | 2,442 | 760 | |
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 21.05s | 97,363 | 6,024 | 911 | |
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 3.69s | 10,503 | 343 | 79 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 5.3 | 10.0 | 33.3% | 0 | 8.91s | 972 | 1,928 | 1,479 | |
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 3.76s | 708 | 293 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.13s | 909 | 242 | 146 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.23s | 894 | 607 | 300 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 9.03s | 11,739 | 354 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 3.0 | 10.0 | 0.0% | 0 | 6.48s | 258 | 363 | 337 | |
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 5lowvsGLM 5.3 FlashmaxClaude Opus 5lowvsGemini 3.5 Flash LitehighClaude Opus 5lowvsMuse Spark 1.3mediumClaude Opus 5lowvsQwen3.8 Max (0902)mediumClaude Opus 5lowvsMuse Spark 1.2highClaude Opus 5lowvsMuse Spark 1.2mediumMuse Spark 1.2highvsQwen3.6 Max PreviewmediumClaude Opus 5lowvsMuse Spark 1.1mediumMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumQwen3.6 Max PreviewmediumvsGLM 5.3 FlashmaxGemini 3.6 FlashlowvsQwen3.6 Max PreviewmediumClaude Opus 5lowvsSeed 2.1 Turbohigh