- Peringkat
- #33
- Total token output
- 359,608
- Waktu respons (rata-rata)
- 52.49s
- Total Biaya
- $1.653
Muse Spark 1.3 (high) vs Qwen3.8 Max (0902) (medium)
Muse Spark 1.3 (high) unggul dalam skor rata-rata dengan 8.9 vs 8.8. Qwen3.8 Max (0902) (medium) memiliki biaya benchmark lebih rendah di $0.677 vs $1.653. Qwen3.8 Max (0902) (medium) lebih cepat di 26.01s vs 52.49s, dengan tingkat keberhasilan 77.3% vs 83.3%.
- Peringkat
- #36
- Total token output
- 80,678
- Waktu respons (rata-rata)
- 26.01s
- Total Biaya
- $0.677
Model yang direkomendasikan
Qwen3.8 Max (0902) (medium)
Its score stays close to the best score here (8.8 vs 8.9), while costing about 2.4x less than Muse Spark 1.3 (high).
Perbandingan terperinci
| Metrik | Muse Spark 1.3 Muse Spark 1.3 high | Qwen3.8 Max (0902) Qwen3.8 Max (0902) medium |
|---|---|---|
| Skor | 8.9 | 8.8 |
| Peringkat | #33 | #36 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.3 | 9.3 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 77.3% | 83.3% |
| Tes tidak stabil | 2 | 2 |
| Total Run | 66 | 66 |
| Biaya per hasil | 10.327 | 3.981 |
| Total Biaya | $1.653 | $0.677 |
| Harga input | $1.250 / 1M | $2.000 / 1M |
| Harga output | $4.250 / 1M | $6.000 / 1M |
| Total token input | 99,143 | 96,323 |
| Token output | 12,083 | 5,961 |
| Token penalaran | 347,525 | 74,717 |
| Waktu respons (rata-rata) | 52.49s | 26.01s |
| Waktu respons (maks) | 251.53s | 168.09s |
| Waktu respons (total) | 1154.76s | 572.19s |
| Parameter | ~1T total (~50B aktif) | 2.4T total (~100B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#33 Muse Spark 1.3
high- Biaya
- $0.050
- Waktu
- 203.3s
- Token
- 11,679 tok
#36 Qwen3.8 Max (0902)
medium- Biaya
- $0.036
- Waktu
- 108.3s
- Token
- 5,980 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 5.71s | 618 | 487 | 8,829 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.03s | 672 | 295 | 2,003 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 51.66s | 7,275 | 1,228 | 64,287 | |
| Qwen3.8 Max (0902) | 8.4 | 7.4 | 88.9% | 1 | 45.74s | 7,893 | 551 | 20,628 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 55.55s | 68,737 | 5,707 | 46,328 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 94.38s | 68,852 | 3,895 | 24,303 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 7.01s | 7,155 | 491 | 6,758 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 10.54s | 7,782 | 261 | 2,591 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 2.9 | 7.2 | 11.1% | 1 | 174.56s | 690 | 801 | 114,774 | |
| Qwen3.8 Max (0902) | 3.6 | 7.2 | 22.2% | 1 | 49.45s | 780 | 44 | 19,572 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 9.49s | 477 | 228 | 2,634 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 7.56s | 516 | 202 | 689 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 6.5 | 10.0 | 50.0% | 0 | 14.70s | 669 | 353 | 10,553 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.24s | 699 | 90 | 886 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 8.7 | 7.7 | 88.9% | 1 | 38.42s | 651 | 1,178 | 37,874 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.89s | 696 | 353 | 1,599 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 9.6 | 10.0 | 100.0% | 0 | 33.95s | 12,688 | 1,046 | 14,673 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.93s | 8,229 | 249 | 194 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 3.0 | 10.0 | 0.0% | 0 | 140.05s | 183 | 564 | 40,815 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 17.01s | 204 | 21 | 2,252 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Muse Spark 1.3highvsGPT-5.3-CodexmediumGemini 3.5 FlashlowvsQwen3.8 Max (0902)mediumGemini 3.5 Flash LitehighvsQwen3.8 Max (0902)mediumClaude Opus 5lowvsQwen3.8 Max (0902)mediumMuse Spark 1.3highvsQwen3.8 MaxmediumGemini 3.6 FlashlowvsQwen3.8 Max (0902)mediumQwen3.8 Max (0902)mediumvsGLM 5.3 FlashmaxMuse Spark 1.3highvsGPT-5.5mediumGemini 3.5 FlashmediumvsMuse Spark 1.3highSeed 2.1 TurbohighvsQwen3.8 Max (0902)mediumGemini 3.5 FlashlowvsMuse Spark 1.3highMuse Spark 1.2highvsQwen3.8 Max (0902)medium