- Rang
- #21
- Totaal aantal uitvoer-tokens
- 36,457
- Responstijd (gem.)
- 25.88s
- Totale kosten
- $1.266
Claude Opus 5.5 (high) vs Qwen3.8 Max (0902) (low)
Claude Opus 5.5 (high) leidt in gemiddelde score met 9.3 vs 9.1. Qwen3.8 Max (0902) (low) heeft lagere benchmarkkosten met $0.664 vs $1.266. Qwen3.8 Max (0902) (low) is sneller met 24.21s vs 25.88s, met slagingspercentages van 86.4% vs 86.4%.
Vergeleken modellen
- Rang
- #27
- Totaal aantal uitvoer-tokens
- 75,865
- Responstijd (gem.)
- 24.21s
- Totale kosten
- $0.664
Aanbevolen model
Qwen3.8 Max (0902) (low)
De score blijft dicht bij de beste score hier (9.1 vs 9.3) en het kost ongeveer 1.9x minder dan Claude Opus 5.5 (high).
Gedetailleerde vergelijking
| Metriek | Claude Opus 5.5 Claude Opus 5.5 high | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Score | 9.3 | 9.1 |
| Rang | #21 | #27 |
| Betrouwbaarheid | 10.0 | 10.0 |
| Consistentie | 9.3 | 9.3 |
| Pogingen | 66/66 | 66/66 |
| Correcte tests | ||
| Slaagpercentage per poging | 86.4% | 86.4% |
| Instabiele tests | 2 | 2 |
| Totaal runs | 66 | 66 |
| Kosten per resultaat | 7.029 | 3.684 |
| Totale kosten | $1.266 | $0.664 |
| Invoerprijs | $4.000 / 1M | $2.000 / 1M |
| Uitvoerprijs | $20.000 / 1M | $6.000 / 1M |
| Totaal aantal invoer-tokens | 134,020 | 103,954 |
| Uitvoer-tokens | 7,237 | 6,322 |
| Redeneer-tokens | 29,220 | 69,543 |
| Responstijd (gem.) | 25.88s | 24.21s |
| Responstijd (max) | 95.95s | 207.79s |
| Responstijd (totaal) | 569.33s | 532.62s |
| Parameters | ~5T totaal (~500B actief) | 2.4T totaal (~100B actief) |
| Beschikbaarheid | Gesloten broncode | Gesloten broncode |
Model generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#21 Claude Opus 5.5
high- Kosten
- $0.136
- Tijd
- 75.6s
- Tokens
- 6,934 tok
#27 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Tijd
- 41.2s
- Tokens
- 2,421 tok
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
| Anti-AI-trucs | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.58s | 858 | 313 | 683 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 13.44s | 10,608 | 584 | 5,042 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Gecombineerd | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 60.05s | 96,745 | 4,683 | 6,301 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Gegevensparsering en extractie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.31s | 10,515 | 312 | 355 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domeinspecifiek | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 5.3 | 7.2 | 44.4% | 1 | 30.08s | 990 | 58 | 14,458 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Algemene intelligentie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.66s | 714 | 283 | 352 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Instructies opvolgen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 21.35s | 921 | 96 | 435 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Puzzeloplossing | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 8.7 | 7.7 | 88.9% | 1 | 30.85s | 912 | 496 | 605 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Toolaanroepen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 75.42s | 11,757 | 412 | 989 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Algemene kennis | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 3.0 | 10.0 | 0.0% | 0 | 27.41s | 0 | 0 | 0 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Snelle vergelijking
Vergelijkingspaar wisselen
Gemini 3.8 FlashmediumvsQwen3.8 Max (0902)lowClaude Opus 5.5highvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5highvsGemini 3.7 FlashlowClaude Opus 5.5highvsGPT-5.5lowClaude Opus 5mediumvsQwen3.8 Max (0902)lowClaude Opus 5highvsQwen3.8 Max (0902)lowClaude Opus 5.5highvsGPT-6 AstramediumClaude Opus 5.5mediumvsQwen3.8 Max (0902)lowClaude Fable 5.1highvsQwen3.8 Max (0902)lowClaude Opus 5.5highvsGPT-5.6 SolmediumClaude Opus 5.5highvsGPT-6 SolmediumGemini 3.5 FlashmediumvsQwen3.8 Max (0902)low