- Peringkat
- #49
- Total token output
- 170,373
- Waktu respons (rata-rata)
- 66.52s
- Total Biaya
- $1.132
Qwen3.6 Max Preview (medium) vs Qwen3.8 Max (low)
Skor rata-rata hampir imbang di 8.6 vs 8.6. Qwen3.8 Max (low) memiliki biaya benchmark lebih rendah di $0.702 vs $1.132. Qwen3.8 Max (low) lebih cepat di 21.83s vs 66.52s, dengan tingkat keberhasilan 83.3% vs 80.3%.
Model yang Dibandingkan
- Peringkat
- #50
- Total token output
- 83,821
- Waktu respons (rata-rata)
- 21.83s
- Total Biaya
- $0.702
Model yang direkomendasikan
Qwen3.8 Max (low)
It has the best score here (8.6), while costing about 1.6x less than Qwen3.6 Max Preview (medium).
Perbandingan terperinci
| Metrik | Qwen3.6 Max Preview Qwen3.6 Max Preview medium | Qwen3.8 Max Qwen3.8 Max low |
|---|---|---|
| Skor | 8.6 | 8.6 |
| Peringkat | #49 | #50 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.3 | 9.0 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 83.3% | 80.3% |
| Tes tidak stabil | 2 | 3 |
| Total Run | 66 | 66 |
| Biaya per hasil | 7.653 | 4.384 |
| Total Biaya | $1.132 | $0.702 |
| Harga input | $1.028 / 1M | $2.000 / 1M |
| Harga output | $6.162 / 1M | $6.000 / 1M |
| Total token input | 79,249 | 99,181 |
| Token output | 5,097 | 6,132 |
| Token penalaran | 165,276 | 77,689 |
| Waktu respons (rata-rata) | 66.52s | 21.83s |
| Waktu respons (maks) | 238.07s | 155.75s |
| Waktu respons (total) | 1463.50s | 480.37s |
| Parameter | ~1T total (~40B aktif) | 2.4T total (~100B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#49 Qwen3.6 Max Preview
medium- Biaya
- $0.024
- Waktu
- 76.5s
- Token
- 3,861 tok
#50 Qwen3.8 Max
low- Biaya
- $0.026
- Waktu
- 68.5s
- Token
- 4,280 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 3.93s | 984 | 228 | 1,750 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 | |
| Qwen3.8 Max | 8.4 | 7.4 | 88.9% | 1 | 28.69s | 8,127 | 512 | 15,952 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 98.19s | 69,994 | 4,221 | 32,937 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 7.87s | 7,938 | 270 | 2,257 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 | |
| Qwen3.8 Max | 2.9 | 7.2 | 11.1% | 1 | 40.12s | 1,014 | 62 | 19,512 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 | |
| Qwen3.8 Max | 6.5 | 3.4 | 66.7% | 1 | 5.29s | 594 | 128 | 568 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 4.01s | 855 | 102 | 851 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 | |
| Qwen3.8 Max | 9.9 | 10.0 | 100.0% | 0 | 4.11s | 930 | 286 | 1,304 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 8.06s | 8,463 | 295 | 693 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 | |
| Qwen3.8 Max | 3.0 | 10.0 | 0.0% | 0 | 12.43s | 282 | 28 | 1,865 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
GPT-5.4mediumvsQwen3.8 MaxlowClaude Fable 5mediumvsQwen3.8 MaxlowMuse Spark 1.1mediumvsQwen3.8 MaxlowMuse Spark 1.2mediumvsQwen3.8 MaxlowDeepSeek V4.1 FlashhighvsQwen3.8 MaxlowDeepSeek V4.1 FlashmediumvsQwen3.8 MaxlowMuse Spark 1.2highvsQwen3.6 Max PreviewmediumQwen3.8 MaxlowvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsQwen3.6 Max PreviewmediumDeepSeek V4.1 FlashhighvsQwen3.6 Max PreviewmediumMuse Spark 1.2highvsQwen3.8 MaxlowMuse Spark 1.2lowvsQwen3.6 Max Previewmedium