- Peringkat
- #134
- Total token output
- 174,547
- Waktu respons (rata-rata)
- 4.32s
- Total Biaya
- $0.031
Mercury 2.5 (high) vs Muse Glimmer 30B (medium)
Muse Glimmer 30B (medium) unggul dalam skor rata-rata dengan 7.2 vs 7.1. Mercury 2.5 (high) memiliki biaya benchmark lebih rendah di $0.031 vs $0.211. Mercury 2.5 (high) lebih cepat di 4.32s vs 30.64s, dengan tingkat keberhasilan 62.1% vs 63.6%.
Model yang Dibandingkan
- Peringkat
- #129
- Total token output
- 168,074
- Waktu respons (rata-rata)
- 30.64s
- Total Biaya
- $0.211
Model yang direkomendasikan
Mercury 2.5 (high)
Its score stays close to the best score here (7.1 vs 7.2), while costing about 6.8x less than Muse Glimmer 30B (medium).
Perbandingan terperinci
| Metrik | Mercury 2.5 Mercury 2.5 high | Muse Glimmer 30B Muse Glimmer 30B medium |
|---|---|---|
| Skor | 7.1 | 7.2 |
| Peringkat | #134 | #129 |
| Keandalan | 9.7 | 10.0 |
| Konsistensi | 8.6 | 7.9 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 62.1% | 63.6% |
| Tes tidak stabil | 4 | 6 |
| Total Run | 66 | 66 |
| Biaya per hasil | 0.259 | 2.543 |
| Total Biaya | $0.031 | $0.211 |
| Harga input | $0.040 / 1M | $0.300 / 1M |
| Harga output | $0.150 / 1M | $1.100 / 1M |
| Total token input | 120,068 | 116,513 |
| Token output | 3,402 | 33,065 |
| Token penalaran | 171,145 | 135,009 |
| Waktu respons (rata-rata) | 4.32s | 30.64s |
| Waktu respons (maks) | 23.63s | 181.08s |
| Waktu respons (total) | 95.06s | 674.01s |
| Parameter | ~100B | 30B |
| Ketersediaan | Tertutup | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#134 Mercury 2.5
high- Biaya
- $0.001
- Waktu
- 3.5s
- Token
- 2,447 tok
#129 Muse Glimmer 30B
medium- Biaya
- $0.003
- Waktu
- 31.9s
- Token
- 1,845 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.33s | 782 | 218 | 7,913 | |
| Muse Glimmer 30B | 9.2 | 8.4 | 91.7% | 1 | 7.36s | 810 | 1,183 | 5,164 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.4 | 7.8 | 44.4% | 1 | 6.58s | 7,757 | 415 | 44,012 | |
| Muse Glimmer 30B | 8.4 | 7.8 | 77.8% | 1 | 33.67s | 7,419 | 4,662 | 20,605 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.4 | 5.8 | 66.7% | 1 | 16.00s | 91,255 | 1,478 | 62,200 | |
| Muse Glimmer 30B | 6.5 | 10.0 | 50.0% | 0 | 76.48s | 88,472 | 4,448 | 29,477 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 3.08s | 8,355 | 557 | 9,430 | |
| Muse Glimmer 30B | 7.3 | 5.9 | 83.3% | 1 | 7.20s | 7,065 | 2,570 | 3,513 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 2.9 | 7.2 | 11.1% | 1 | 4.86s | 857 | 78 | 22,452 | |
| Muse Glimmer 30B | 2.9 | 7.2 | 11.1% | 1 | 44.62s | 885 | 10,588 | 25,769 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 5.0 | 10.0 | 0.0% | 0 | 2.69s | 528 | 93 | 3,609 | |
| Muse Glimmer 30B | 4.7 | 9.8 | 0.0% | 0 | 5.16s | 525 | 1,312 | 1,379 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.5 | 10.0 | 50.0% | 0 | 934ms | 401 | 27 | 1,770 | |
| Muse Glimmer 30B | 9.8 | 10.0 | 100.0% | 0 | 5.34s | 765 | 1,206 | 2,359 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 8.7 | 7.7 | 88.9% | 1 | 1.39s | 771 | 227 | 5,812 | |
| Muse Glimmer 30B | 6.0 | 4.6 | 66.7% | 2 | 64.73s | 795 | 6,278 | 39,397 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 3.06s | 9,130 | 283 | 4,484 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 5.64s | 9,546 | 320 | 839 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 3.0 | 10.0 | 0.0% | 0 | 5.48s | 232 | 26 | 9,463 | |
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 26.69s | 231 | 498 | 6,507 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Muse Glimmer 30BmediumvsQwen3.7 FlashlowMercury 2.5highvsGrok 4.3mediumMercury 2.5highvsGPT-5.6 SolnoneMuse Glimmer 30BmediumvsStep 3.7 FlashlowMercury 2.5highvsStep 3.7 FlashlowDeepSeek V3.2mediumvsMercury 2.5highMercury 2.5highvsMuse Glimmer 30BlowKAT-Coder-Pro V2.5highvsMuse Glimmer 30BmediumMuse Glimmer 30BmediumvsSolar Pro 4highMercury 2.5highvsQwen3.5-122B-A10BmediumMercury 2.5highvsGLM 5.1mediumMercury 2.5highvsGPT-5.5none