- Peringkat
- #35
- Total token output
- 170,373
- Waktu respons (rata-rata)
- 66.52s
- Total Biaya
- $1.132
Qwen3.6 Max Preview (medium) vs Grok 4.5 (low)
Qwen3.6 Max Preview (medium) unggul dalam skor rata-rata dengan 8.6 vs 8.4. Grok 4.5 (low) memiliki biaya benchmark lebih rendah di $0.945 vs $1.132. Grok 4.5 (low) lebih cepat di 16.17s vs 66.52s, dengan tingkat keberhasilan 83.3% vs 77.3%.
- Peringkat
- #41
- Total token output
- 115,489
- Waktu respons (rata-rata)
- 16.17s
- Total Biaya
- $0.945
Model yang direkomendasikan
Grok 4.5 (low)
Its score stays close to the best score here (8.4 vs 8.6), while responding about 4.1x faster than Qwen3.6 Max Preview (medium).
Perbandingan terperinci
| Metrik | Qwen3.6 Max Preview Qwen3.6 Max Preview medium | Grok 4.5 Grok 4.5 low |
|---|---|---|
| Skor | 8.6 | 8.4 |
| Peringkat | #35 | #41 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.3 | 9.3 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 83.3% | 77.3% |
| Tes tidak stabil | 2 | 2 |
| Total Run | 66 | 66 |
| Biaya per hasil | 7.653 | 5.901 |
| Total Biaya | $1.132 | $0.945 |
| Harga input | $1.028 / 1M | $2.000 / 1M |
| Harga output | $6.162 / 1M | $6.000 / 1M |
| Total token input | 79,249 | 125,605 |
| Token output | 5,097 | 7,505 |
| Token penalaran | 165,276 | 107,984 |
| Waktu respons (rata-rata) | 66.52s | 16.17s |
| Waktu respons (maks) | 238.07s | 205.28s |
| Waktu respons (total) | 1463.50s | 355.67s |
| Parameter | ~1T total (~40B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#35 Qwen3.6 Max Preview
medium- Biaya
- $0.024
- Waktu
- 76.5s
- Token
- 3,861 tok
#41 SpaceXAI: Grok 4.5
low- Biaya
- $0.011
- Waktu
- 12.4s
- Token
- 2,018 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 2,991 | 261 | 3,000 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 13.72s | 9,579 | 303 | 15,641 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 | |
| Grok 4.5 | 6.5 | 10.0 | 50.0% | 0 | 12.75s | 82,028 | 6,031 | 3,583 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 3.44s | 8,937 | 225 | 2,549 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 | |
| Grok 4.5 | 2.9 | 7.2 | 11.1% | 1 | 77.09s | 2,523 | 14 | 71,813 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 | |
| Grok 4.5 | 6.1 | 3.1 | 66.7% | 1 | 4.88s | 1,077 | 98 | 1,253 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 | |
| Grok 4.5 | 9.8 | 10.0 | 100.0% | 0 | 2.80s | 1,857 | 57 | 1,878 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 3.20s | 2,430 | 217 | 2,590 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 5.83s | 13,394 | 284 | 871 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 | |
| Grok 4.5 | 3.0 | 10.0 | 0.0% | 0 | 13.98s | 789 | 15 | 4,806 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
GPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowInkling SmallhighvsGrok 4.5lowMuse Spark 1.2highvsQwen3.6 Max PreviewmediumMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumGPT-5.4mediumvsGrok 4.5lowQwen3.6 Max PreviewmediumvsGLM 5.3 FlashmaxGemini 3.6 FlashlowvsQwen3.6 Max PreviewmediumClaude Opus 5lowvsQwen3.6 Max PreviewmediumGemini 2.5 FlashmediumvsGrok 4.5lowGemini 3.5 Flash LitehighvsQwen3.6 Max Previewmedium