- Peringkat
- #120
- Total token output
- 37,467
- Waktu respons (rata-rata)
- 30.98s
- Total Biaya
- $0.662
Ember-1 (low) vs Grok 4.7 (xhigh)
Grok 4.7 (xhigh) unggul dalam skor rata-rata dengan 7.5 vs 7.5. Ember-1 (low) memiliki biaya benchmark lebih rendah di $0.662 vs $2.625. Ember-1 (low) lebih cepat di 30.98s vs 115.74s, dengan tingkat keberhasilan 66.7% vs 77.3%.
Model yang Dibandingkan
- Peringkat
- #116
- Total token output
- 505,069
- Waktu respons (rata-rata)
- 115.74s
- Total Biaya
- $2.625
Model yang direkomendasikan
Ember-1 (low)
Its score stays close to the best score here (7.5 vs 7.5), while costing about 4.0x less than Grok 4.7 (xhigh).
Perbandingan terperinci
| Metrik | Ember-1 Ember-1 low | Grok 4.7 Grok 4.7 xhigh |
|---|---|---|
| Skor | 7.5 | 7.5 |
| Peringkat | #120 | #116 |
| Keandalan | 8.1 | 9.6 |
| Konsistensi | 8.5 | 7.7 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 66.7% | 77.3% |
| Tes tidak stabil | 4 | 6 |
| Total Run | 66 | 66 |
| Biaya per hasil | 5.085 | 18.745 |
| Total Biaya | $0.662 | $2.625 |
| Harga input | $3.000 / 1M | $1.600 / 1M |
| Harga output | $15.000 / 1M | $4.800 / 1M |
| Total token input | 33,011 | 124,896 |
| Token output | 4,780 | 4,890 |
| Token penalaran | 32,687 | 500,179 |
| Waktu respons (rata-rata) | 30.98s | 115.74s |
| Waktu respons (maks) | 93.10s | 775.64s |
| Waktu respons (total) | 681.50s | 2546.31s |
| Parameter | ~2.8T total (~104B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#120 Ember-1
low- Biaya
- $0.016
- Waktu
- 24.2s
- Token
- 1,165 tok
#116 SpaceXAI: Grok 4.7
xhigh- Biaya
- $0.235
- Waktu
- 544.2s
- Token
- 39,247 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
Perbandingan Cepat
Ganti Pasangan Perbandingan
Ember-1lowvsMiniMax M3mediumEmber-1lowvsGrok 4.7highClaude Opus 5nonevsGrok 4.7xhighEmber-1lowvsGPT 5.3 ChatnoneEmber-1lowvsQwen3.5 Plus 2026-02-15mediumEmber-1lowvsQwen3.5-27BmediumNemotron 3 UltramediumTersedia gratisvsGrok 4.7xhighEmber-1lowvsMercury 2.5 PreviewmediumGPT-5.4 NanomediumvsGrok 4.7xhighGPT-5.6 LunahighvsGrok 4.7xhighEmber-1lowvsGPT-5.4 MinimediumEmber-1lowvsGrok Build 0.1medium