- Rang
- #43
- Gesamte Ausgabe-Token
- 29,990
- Antwortzeit (Durchschnitt)
- 7.62s
- Gesamtkosten
- $1.476
Claude Opus 4.7 (medium) vs Qwen3.6 Max Preview (medium)
Claude Opus 4.7 (medium) führt beim Durchschnittsscore mit 8.7 vs 8.6. Qwen3.6 Max Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.132 vs $1.476. Claude Opus 4.7 (medium) ist schneller mit 7.62s vs 66.52s, mit Erfolgsraten von 83.3% vs 83.3%.
Verglichene Modelle
- Rang
- #48
- Gesamte Ausgabe-Token
- 170,373
- Antwortzeit (Durchschnitt)
- 66.52s
- Gesamtkosten
- $1.132
Empfohlenes Modell
Claude Opus 4.7 (medium)
Es hat hier die beste Punktzahl (8.7) und antwortet etwa 8.7x schneller als Qwen3.6 Max Preview (medium).
Detaillierter Vergleich
| Metrik | Claude Opus 4.7 Claude Opus 4.7 medium | Qwen3.6 Max Preview Qwen3.6 Max Preview medium |
|---|---|---|
| Punktzahl | 8.7 | 8.6 |
| Rang | #43 | #48 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 83.3% |
| Instabile Tests | 1 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 8.200 | 7.653 |
| Gesamtkosten | $1.476 | $1.132 |
| Eingabepreis | $5.000 / 1M | $1.028 / 1M |
| Ausgabepreis | $25.000 / 1M | $6.162 / 1M |
| Gesamte Eingabe-Token | 145,249 | 79,249 |
| Ausgabe-Token | 24,948 | 5,097 |
| Denk-Token | 5,042 | 165,276 |
| Antwortzeit (Durchschnitt) | 7.62s | 66.52s |
| Antwortzeit (Maximum) | 65.40s | 238.07s |
| Antwortzeit (Gesamt) | 159.94s | 1463.50s |
| Parameter | ~5T insgesamt (~500B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#43 Claude Opus 4.7
medium- Kosten
- $0.059
- Zeit
- 26.8s
- Token
- 2,475 tok
#48 Qwen3.6 Max Preview
medium- Kosten
- $0.024
- Zeit
- 76.5s
- Token
- 3,861 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 8.3 | 10.0 | 75.0% | 0 | 1.85s | 894 | 348 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 7.6 | 7.2 | 77.8% | 1 | 12.96s | 10,635 | 7,629 | 1,114 | |
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 43.42s | 104,347 | 15,459 | 3,928 | |
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.37s | 10,533 | 324 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 7.7 | 10.0 | 66.7% | 0 | 1.19s | 627 | 51 | 0 | |
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.87s | 723 | 256 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 1.57s | 939 | 114 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.43s | 939 | 370 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 15,339 | 373 | 0 | |
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 3.0 | 10.0 | 0.0% | 0 | 2.25s | 273 | 24 | 0 | |
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 4.7mediumvsGLM 5.3 FlashmaxClaude Opus 4.7mediumvsGemini 3.6 FlashlowClaude Opus 4.7mediumvsMuse Spark 1.2highClaude Opus 4.7mediumvsGemini 3.5 Flash LitehighMuse Spark 1.2highvsQwen3.6 Max PreviewmediumClaude Opus 4.7mediumvsGemini 3.5 FlashlowMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumQwen3.6 Max PreviewmediumvsGLM 5.3 FlashmaxGemini 3.6 FlashlowvsQwen3.6 Max PreviewmediumClaude Opus 4.7mediumvsQwen3.8 MaxlowClaude Opus 5lowvsQwen3.6 Max PreviewmediumQwen3.6 Max PreviewmediumvsGrok 4.5low