- Peringkat
- #37
- Total token output
- 319,264
- Waktu respons (rata-rata)
- 38.57s
- Total Biaya
- $1.469
Muse Spark 1.3 (medium) vs Qwen3.8 Max (0902) (high)
Qwen3.8 Max (0902) (high) unggul dalam skor rata-rata dengan 8.9 vs 8.8. Muse Spark 1.3 (medium) memiliki biaya benchmark lebih rendah di $1.469 vs $2.736. Muse Spark 1.3 (medium) lebih cepat di 38.57s vs 185.56s, dengan tingkat keberhasilan 84.9% vs 86.4%.
- Peringkat
- #31
- Total token output
- 419,443
- Waktu respons (rata-rata)
- 185.56s
- Total Biaya
- $2.736
Model yang direkomendasikan
Muse Spark 1.3 (medium)
Its score stays close to the best score here (8.8 vs 8.9), while costing about 1.9x less than Qwen3.8 Max (0902) (high).
Perbandingan terperinci
| Metrik | Muse Spark 1.3 Muse Spark 1.3 medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) high |
|---|---|---|
| Skor | 8.8 | 8.9 |
| Peringkat | #37 | #31 |
| Keandalan | 10.0 | 9.8 |
| Konsistensi | 8.9 | 9.0 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 84.9% | 86.4% |
| Tes tidak stabil | 3 | 3 |
| Total Run | 66 | 66 |
| Biaya per hasil | 8.638 | 16.089 |
| Total Biaya | $1.469 | $2.736 |
| Harga input | $1.250 / 1M | $2.000 / 1M |
| Harga output | $4.250 / 1M | $6.000 / 1M |
| Total token input | 89,177 | 109,226 |
| Token output | 11,044 | 6,890 |
| Token penalaran | 308,220 | 412,553 |
| Waktu respons (rata-rata) | 38.57s | 185.56s |
| Waktu respons (maks) | 219.77s | 912.78s |
| Waktu respons (total) | 848.59s | 4082.41s |
| Parameter | ~1T total (~50B aktif) | 2.4T total (~100B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 Muse Spark 1.3
medium- Biaya
- $0.025
- Waktu
- 113.4s
- Token
- 5,952 tok
#31 Qwen3.8 Max (0902)
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Biaya
- $0.000
- Waktu
- 600.0s
- Token
- 0 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 5.83s | 618 | 448 | 8,507 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 15.86s | 1,128 | 263 | 6,631 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 41.14s | 7,275 | 1,182 | 46,737 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 253.22s | 8,235 | 418 | 91,734 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 7.3 | 5.8 | 83.3% | 1 | 34.71s | 58,867 | 4,645 | 28,798 | |
| Qwen3.8 Max (0902) | 8.7 | 6.9 | 83.3% | 1 | 110.39s | 79,527 | 5,215 | 28,102 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 8.75s | 7,155 | 466 | 6,751 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 16.37s | 8,010 | 261 | 3,598 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 3.5 | 4.4 | 33.3% | 2 | 132.33s | 738 | 1,635 | 144,687 | |
| Qwen3.8 Max (0902) | 5.9 | 7.2 | 55.6% | 1 | 658.46s | 842 | 31 | 154,450 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 7.95s | 477 | 236 | 2,303 | |
| Qwen3.8 Max (0902) | 6.5 | 3.4 | 66.7% | 1 | 75.11s | 630 | 80 | 8,110 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 9.8 | 10.0 | 100.0% | 0 | 10.49s | 669 | 319 | 8,140 | |
| Qwen3.8 Max (0902) | 9.8 | 10.0 | 100.0% | 0 | 7.55s | 927 | 86 | 1,823 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 25.03s | 651 | 640 | 24,761 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 134.14s | 1,038 | 268 | 47,351 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 9.6 | 10.0 | 100.0% | 0 | 28.30s | 12,544 | 859 | 8,690 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.21s | 8,571 | 249 | 243 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 3.0 | 10.0 | 0.0% | 0 | 85.61s | 183 | 614 | 28,846 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 532.59s | 318 | 19 | 70,511 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
GPT-5.3-CodexmediumvsQwen3.8 Max (0902)highGemini 3.5 Flash LitehighvsMuse Spark 1.3mediumClaude Opus 5lowvsMuse Spark 1.3mediumGemini 3.6 FlashlowvsMuse Spark 1.3mediumMuse Spark 1.3mediumvsGLM 5.3 FlashmaxGemini 3.5 FlashlowvsMuse Spark 1.3mediumGPT-5.5mediumvsQwen3.8 Max (0902)highGemini 3.5 FlashmediumvsQwen3.8 Max (0902)highGemini 3.5 FlashlowvsQwen3.8 Max (0902)highSeed 2.1 TurbohighvsMuse Spark 1.3mediumSeed 2.1 TurbolowvsQwen3.8 Max (0902)highGemini 3.8 FlashmediumvsQwen3.8 Max (0902)high