- Peringkat
- #185
- Total token output
- 6,197
- Waktu respons (rata-rata)
- 4.75s
- Total Biaya
- $1.212
GPT-5.5 vs Grok 4.7 (high)
Skor rata-rata hampir imbang di 6.6 vs 6.7. GPT-5.5 memiliki biaya benchmark lebih rendah di $1.212 vs $3.582. GPT-5.5 lebih cepat di 4.75s vs 122.19s, dengan tingkat keberhasilan 56.5% vs 72.5%.
Model yang Dibandingkan
- Peringkat
- #179
- Total token output
- 487,184
- Waktu respons (rata-rata)
- 122.19s
- Total Biaya
- $3.582
Model yang direkomendasikan
GPT-5.5
It has the best score here (6.6), while costing about 3.0x less than Grok 4.7 (high).
Perbandingan terperinci
| Metrik | GPT-5.5 GPT-5.5 none | Grok 4.7 Grok 4.7 high |
|---|---|---|
| Skor | 6.6 | 6.7 |
| Peringkat | #185 | #179 |
| Keandalan | 10.0 | 9.6 |
| Konsistensi | 9.3 | 7.7 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 56.5% | 72.5% |
| Tes tidak stabil | 2 | 7 |
| Total Run | 69 | 69 |
| Biaya per hasil | 10.096 | 23.360 |
| Total Biaya | $1.212 | $3.582 |
| Harga input | $5.000 / 1M | $2.000 / 1M |
| Harga output | $30.000 / 1M | $6.000 / 1M |
| Total token input | 205,108 | 329,276 |
| Token output | 6,197 | 8,172 |
| Token penalaran | 0 | 479,012 |
| Waktu respons (rata-rata) | 4.75s | 122.19s |
| Waktu respons (maks) | 57.53s | 573.57s |
| Waktu respons (total) | 109.31s | 2810.40s |
| Parameter | ~1.5T total (~100B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#185 GPT-5.5
none- Biaya
- $0.090
- Waktu
- 54.3s
- Token
- 3,063 tok
#179 SpaceXAI: Grok 4.7
high- Biaya
- $0.110
- Waktu
- 301.3s
- Token
- 23,143 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
Perbandingan Cepat
Ganti Pasangan Perbandingan
MiniMax M3mediumvsGrok 4.7highGPT-5.5nonevsGLM 5.3 FlashlowEmber-1maxvsGrok 4.7highGPT 5.3 ChatnonevsGrok 4.7highGPT-5.6 SolnonevsGrok 4.7highSolar Pro 4lowvsGrok 4.7highQwen3.5-FlashnonevsGrok 4.7highGPT-5.5nonevsQwen3.7 FlashmediumEmber-1maxvsGPT-5.5noneGrok 4.7highvsGLM 5.3 FlashlowMiniMax M3mediumvsGPT-5.5noneLongCat 2.0lowvsGPT-5.5none