- Peringkat
- #133
- Total token output
- 32,506
- Waktu respons (rata-rata)
- 11.87s
- Total Biaya
- $3.197
Claude Fable 5.1 (medium) vs Grok 4.7 (low)
Grok 4.7 (low) unggul dalam skor rata-rata dengan 7.4 vs 7.3. Grok 4.7 (low) memiliki biaya benchmark lebih rendah di $2.263 vs $3.197. Claude Fable 5.1 (medium) lebih cepat di 11.87s vs 63.19s, dengan tingkat keberhasilan 78.3% vs 73.9%.
Model yang Dibandingkan
- Peringkat
- #127
- Total token output
- 255,329
- Waktu respons (rata-rata)
- 63.19s
- Total Biaya
- $2.263
Model yang direkomendasikan
Claude Fable 5.1 (medium)
Its score stays close to the best score here (7.3 vs 7.4), while responding about 5.3x faster than Grok 4.7 (low).
Perbandingan terperinci
| Metrik | Claude Fable 5.1 Claude Fable 5.1 medium | Grok 4.7 Grok 4.7 low |
|---|---|---|
| Skor | 7.3 | 7.4 |
| Peringkat | #133 | #127 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 7.9 | 8.3 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 78.3% | 73.9% |
| Tes tidak stabil | 6 | 5 |
| Total Run | 69 | 69 |
| Biaya per hasil | 21.312 | 13.804 |
| Total Biaya | $3.197 | $2.263 |
| Harga input | $10.000 / 1M | $2.000 / 1M |
| Harga output | $50.000 / 1M | $6.000 / 1M |
| Total token input | 157,142 | 365,119 |
| Token output | 8,149 | 8,118 |
| Token penalaran | 24,357 | 247,211 |
| Waktu respons (rata-rata) | 11.87s | 63.19s |
| Waktu respons (maks) | 36.59s | 389.63s |
| Waktu respons (total) | 272.91s | 1453.28s |
| Parameter | ~9.5T total (~878B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#133 Claude Fable 5.1
medium- Biaya
- $0.244
- Waktu
- 65.9s
- Token
- 5,025 tok
#127 SpaceXAI: Grok 4.7
low- Biaya
- $0.007
- Waktu
- 15.2s
- Token
- 1,537 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 16.18s | 22,030 | 555 | 799 | |
| Grok 4.7 | 5.0 | 10.0 | 0.0% | 0 | 154.86s | 236,287 | 1,278 | 22,203 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 8.2 | 7.9 | 83.3% | 1 | 5.18s | 858 | 485 | 334 | |
| Grok 4.7 | 10.0 | 10.0 | 100.0% | 0 | 9.92s | 2,991 | 94 | 7,306 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.0 | 5.0 | 77.8% | 2 | 10.99s | 10,608 | 525 | 4,376 | |
| Grok 4.7 | 8.4 | 7.4 | 88.9% | 1 | 189.08s | 9,579 | 346 | 99,053 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 32.59s | 97,573 | 4,993 | 4,831 | |
| Grok 4.7 | 7.3 | 5.8 | 83.3% | 1 | 31.17s | 90,114 | 5,684 | 6,430 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.47s | 10,515 | 312 | 0 | |
| Grok 4.7 | 10.0 | 10.0 | 100.0% | 0 | 4.88s | 8,937 | 225 | 2,050 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 19.29s | 990 | 63 | 9,185 | |
| Grok 4.7 | 5.3 | 10.0 | 33.3% | 0 | 159.09s | 2,523 | 17 | 84,957 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.14s | 714 | 280 | 0 | |
| Grok 4.7 | 4.1 | 2.7 | 33.3% | 1 | 11.32s | 1,077 | 75 | 2,060 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.3 | 5.8 | 83.3% | 1 | 5.77s | 921 | 146 | 183 | |
| Grok 4.7 | 8.4 | 6.9 | 83.3% | 1 | 6.19s | 1,857 | 57 | 2,559 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.6 | 7.2 | 77.8% | 1 | 5.70s | 912 | 422 | 352 | |
| Grok 4.7 | 8.2 | 7.2 | 88.9% | 1 | 12.45s | 2,430 | 151 | 6,628 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 11,757 | 354 | 0 | |
| Grok 4.7 | 10.0 | 10.0 | 100.0% | 0 | 4.26s | 8,535 | 174 | 336 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 24.32s | 264 | 14 | 4,297 | |
| Grok 4.7 | 3.0 | 10.0 | 0.0% | 0 | 76.84s | 789 | 17 | 13,629 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Grok 4.7lowvsGLM 5.3 FlashXhighSeed-2.0-CodemediumvsGrok 4.7lowInkling SmallhighTersedia gratisvsGrok 4.7lowClaude Fable 5.1mediumvsGLM 5.3 FlashhighQwen3.6 FlashmediumvsGrok 4.7lowClaude Fable 5.1mediumvsLongCat 2.0highGPT-5.6 LunamediumvsGrok 4.7lowDeepSeek V4 Pro 0423nonevsGrok 4.7lowInklingmediumTersedia gratisvsGrok 4.7lowGemma 4 26B A4BmediumTersedia gratisvsGrok 4.7lowClaude Fable 5.1mediumvsQwen3.5-27BnoneClaude Fable 5.1mediumvsDeepSeek V4 Pro 0423none