- Peringkat
- #112
- Total token output
- 121,415
- Waktu respons (rata-rata)
- 18.14s
- Total Biaya
- $1.345
Grok 4.5 — low vs medium
medium unggul dalam skor rata-rata dengan 7.8 vs 7.8. low memiliki biaya benchmark lebih rendah di $1.345 vs $2.996. low lebih cepat di 18.14s vs 68.44s, dengan tingkat keberhasilan 73.9% vs 79.7%.
Model yang Dibandingkan
- Peringkat
- #107
- Total token output
- 306,044
- Waktu respons (rata-rata)
- 68.44s
- Total Biaya
- $2.996
Model yang direkomendasikan
low
Its score stays close to the best score here (7.8 vs 7.8), while costing about 2.2x less than Grok 4.5 (medium).
Perbandingan terperinci
| Metrik | Grok 4.5 Grok 4.5 low | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Skor | 7.8 | 7.8 |
| Peringkat | #112 | #107 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.3 | 9.0 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 73.9% | 79.7% |
| Tes tidak stabil | 2 | 3 |
| Total Run | 69 | 69 |
| Biaya per hasil | 8.404 | 14.430 |
| Total Biaya | $1.345 | $2.996 |
| Harga input | $2.000 / 1M | $2.000 / 1M |
| Harga output | $6.000 / 1M | $6.000 / 1M |
| Harga baca cache | $0.300 / 1M | $0.300 / 1M |
| Harga tulis cache | T/A | T/A |
| Total token input | 308,068 | 308,369 |
| Token output | 9,218 | 7,013 |
| Token penalaran | 112,197 | 299,031 |
| Waktu respons (rata-rata) | 18.14s | 68.44s |
| Waktu respons (maks) | 205.28s | 436.38s |
| Waktu respons (total) | 417.21s | 1574.14s |
| Parameter | ~1.7T total (~170B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#112 SpaceXAI: Grok 4.5
low- Biaya
- $0.011
- Waktu
- 12.4s
- Token
- 2,018 tok
#107 SpaceXAI: Grok 4.5
medium- Biaya
- $0.044
- Waktu
- 59.4s
- Token
- 7,512 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
Perbandingan Cepat
Ganti Pasangan Perbandingan
DeepSeek V4 Flash 0731mediumvsGrok 4.5lowGrok 4.5mediumvsGLM 5.3highQwen3.7 PlusnonevsGrok 4.5lowLing 3.1 FlashhighvsGrok 4.5mediumStep 3.7 FlashmediumvsGrok 4.5lowQwen3.8 2.4T A95BhighvsGrok 4.5mediumQwen3.7 PlusnonevsGrok 4.5mediumGrok 4.5lowvsGLM 5.3highGPT-6 LunahighvsGrok 4.5lowMuse Glimmer 30BhighvsGrok 4.5lowLing 3.1 FlashhighvsGrok 4.5lowQwen3.7 MaxnonevsGrok 4.5medium