- Peringkat
- #30
- Total token output
- 27,194
- Waktu respons (rata-rata)
- 24.18s
- Total Biaya
- $1.080
Claude Opus 5.5 (medium) vs Qwen3.8 Max (medium)
Skor rata-rata hampir imbang di 9.0 vs 9.0. Qwen3.8 Max (medium) memiliki biaya benchmark lebih rendah di $0.771 vs $1.080. Qwen3.8 Max (medium) lebih cepat di 23.34s vs 24.18s, dengan tingkat keberhasilan 89.4% vs 80.3%.
Model yang Dibandingkan
- Peringkat
- #34
- Total token output
- 92,047
- Waktu respons (rata-rata)
- 23.34s
- Total Biaya
- $0.771
Model yang direkomendasikan
Qwen3.8 Max (medium)
It has the strongest score in this comparison (9.0) and the best overall balance of cost and response time across all 2 models.
Perbandingan terperinci
| Metrik | Claude Opus 5.5 Claude Opus 5.5 medium | Qwen3.8 Max Qwen3.8 Max medium |
|---|---|---|
| Skor | 9.0 | 9.0 |
| Peringkat | #30 | #34 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.6 | 9.7 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 89.4% | 80.3% |
| Tes tidak stabil | 1 | 1 |
| Total Run | 66 | 66 |
| Biaya per hasil | 5.683 | 4.532 |
| Total Biaya | $1.080 | $0.771 |
| Harga input | $4.000 / 1M | $2.000 / 1M |
| Harga output | $20.000 / 1M | $6.000 / 1M |
| Total token input | 133,954 | 109,055 |
| Token output | 7,292 | 6,566 |
| Token penalaran | 19,902 | 85,481 |
| Waktu respons (rata-rata) | 24.18s | 23.34s |
| Waktu respons (maks) | 90.20s | 126.60s |
| Waktu respons (total) | 532.04s | 513.47s |
| Parameter | ~5T total (~500B aktif) | 2.4T total (~100B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#30 Claude Opus 5.5
medium- Biaya
- $0.053
- Waktu
- 25.6s
- Token
- 2,781 tok
#34 Qwen3.8 Max
medium- Biaya
- $0.028
- Waktu
- 71.9s
- Token
- 4,750 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.42s | 858 | 321 | 657 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 672 | 312 | 2,075 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 8.4 | 7.4 | 88.9% | 1 | 13.50s | 10,608 | 636 | 4,341 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 41.35s | 7,893 | 430 | 23,804 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.69s | 96,679 | 4,639 | 4,527 | |
| Qwen3.8 Max | 8.7 | 6.9 | 83.3% | 1 | 91.25s | 81,584 | 4,526 | 30,688 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 10,515 | 312 | 277 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 8.72s | 7,782 | 270 | 2,519 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 7.7 | 10.0 | 66.7% | 0 | 21.35s | 990 | 61 | 8,360 | |
| Qwen3.8 Max | 3.0 | 10.0 | 0.0% | 0 | 41.77s | 780 | 62 | 20,803 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.17s | 714 | 273 | 326 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 6.41s | 516 | 168 | 700 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 21.33s | 921 | 96 | 336 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 3.49s | 699 | 102 | 914 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 30.12s | 912 | 513 | 491 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 4.93s | 696 | 401 | 1,575 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 74.20s | 11,757 | 441 | 587 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 7.83s | 8,229 | 267 | 636 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 3.0 | 10.0 | 0.0% | 0 | 27.75s | 0 | 0 | 0 | |
| Qwen3.8 Max | 3.0 | 10.0 | 0.0% | 0 | 11.49s | 204 | 28 | 1,767 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Qwen3.8 MaxmediumvsGrok 4.5highClaude Fable 5.1highvsQwen3.8 MaxmediumClaude Opus 5.5mediumvsGrok 4.5highMuse Spark 1.3highvsQwen3.8 MaxmediumClaude Opus 5.5mediumvsSeed 2.1 TurbolowClaude Opus 5.5mediumvsQwen3.8 Max (0902)highQwen3.8 MaxmediumvsParetononeSeed 2.1 TurbohighvsQwen3.8 MaxmediumClaude Opus 5.5mediumvsMuse Spark 1.3highClaude Opus 5.5mediumvsQwen3.8 Max (0902)lowSeed 2.1 TurbolowvsQwen3.8 MaxmediumClaude Opus 5.5mediumvsParetonone