- Peringkat
- #159
- Total token output
- 42,315
- Waktu respons (rata-rata)
- 16.44s
- Total Biaya
- $0.781
Grok 4.6 (low) vs MiMo-V2.5 (medium)
MiMo-V2.5 (medium) unggul dalam skor rata-rata dengan 7.1 vs 6.9. MiMo-V2.5 (medium) memiliki biaya benchmark lebih rendah di $0.419 vs $0.781. Grok 4.6 (low) lebih cepat di 16.44s vs 49.20s, dengan tingkat keberhasilan 66.7% vs 69.6%.
Model yang Dibandingkan
- Peringkat
- #152
- Total token output
- 341,511
- Waktu respons (rata-rata)
- 49.20s
- Total Biaya
- $0.419
Model yang direkomendasikan
MiMo-V2.5 (medium)
It has the best score here (7.1), while costing about 1.9x less than Grok 4.6 (low).
Perbandingan terperinci
| Metrik | Grok 4.6 Grok 4.6 low | MiMo-V2.5 MiMo-V2.5 medium |
|---|---|---|
| Skor | 6.9 | 7.1 |
| Peringkat | #159 | #152 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.6 | 7.6 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 66.7% | 69.6% |
| Tes tidak stabil | 1 | 7 |
| Total Run | 69 | 69 |
| Biaya per hasil | 5.205 | 3.491 |
| Total Biaya | $0.781 | $0.419 |
| Harga input | $2.000 / 1M | $0.140 / 1M |
| Harga output | $6.000 / 1M | $0.280 / 1M |
| Total token input | 263,427 | 259,664 |
| Token output | 6,006 | 8,414 |
| Token penalaran | 36,309 | 333,097 |
| Waktu respons (rata-rata) | 16.44s | 49.20s |
| Waktu respons (maks) | 57.97s | 316.27s |
| Waktu respons (total) | 378.14s | 1131.69s |
| Parameter | ~1.7T total (~170B aktif) | 310B total (15B aktif) |
| Ketersediaan | Tertutup | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#159 SpaceXAI: Grok 4.6
low- Biaya
- $0.011
- Waktu
- 26.0s
- Token
- 1,941 tok
#152 MiMo-V2.5
medium- Biaya
- $0.002
- Waktu
- 54.8s
- Token
- 5,247 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
Perbandingan Cepat
Ganti Pasangan Perbandingan
Qwen3.5-122B-A10BmediumvsGrok 4.6lowGPT-5.2 ChatnonevsMiMo-V2.5mediumKimi K2.7 CodemediumvsGrok 4.6lowGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowGemini 3.1 Flash LitemediumvsGrok 4.6lowEmber-1highvsGrok 4.6lowGPT-5.2 ChatnonevsGrok 4.6lowEmber-1lowvsMiMo-V2.5mediumGemma 4 31BmediumTersedia gratisvsGrok 4.6lowClaude Opus 5nonevsMiMo-V2.5mediumClaude Opus 4.8nonevsGrok 4.6lowGemini 3 Flash PreviewlowvsMiMo-V2.5medium