- Peringkat
- #22
- Total token output
- 97,238
- Waktu respons (rata-rata)
- 20.62s
- Total Biaya
- $1.352
Gemini 3.1 Pro Preview (medium) vs Grok 4.6 (high)
Grok 4.6 (high) unggul dalam skor rata-rata dengan 9.3 vs 9.2. Gemini 3.1 Pro Preview (medium) memiliki biaya benchmark lebih rendah di $1.352 vs $1.908. Gemini 3.1 Pro Preview (medium) lebih cepat di 20.62s vs 84.15s, dengan tingkat keberhasilan 90.9% vs 86.4%.
Model yang Dibandingkan
- Peringkat
- #19
- Total token output
- 282,217
- Waktu respons (rata-rata)
- 84.15s
- Total Biaya
- $1.908
Model yang direkomendasikan
Gemini 3.1 Pro Preview (medium)
Its score stays close to the best score here (9.2 vs 9.3), while responding about 4.1x faster than Grok 4.6 (high).
Perbandingan terperinci
| Metrik | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium | Grok 4.6 Grok 4.6 high |
|---|---|---|
| Skor | 9.2 | 9.3 |
| Peringkat | #22 | #19 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 10.0 | 10.0 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 90.9% | 86.4% |
| Tes tidak stabil | 0 | 0 |
| Total Run | 66 | 66 |
| Biaya per hasil | 6.758 | 10.042 |
| Total Biaya | $1.352 | $1.908 |
| Harga input | $2.000 / 1M | $2.000 / 1M |
| Harga output | $12.000 / 1M | $6.000 / 1M |
| Total token input | 92,296 | 107,275 |
| Token output | 5,232 | 5,094 |
| Token penalaran | 92,006 | 277,123 |
| Waktu respons (rata-rata) | 20.62s | 84.15s |
| Waktu respons (maks) | 88.68s | 618.49s |
| Waktu respons (total) | 329.94s | 1851.26s |
| Parameter | ~1.2T total (~20B aktif) | ~1.7T total (~170B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#22 Gemini 3.1 Pro Preview
medium- Biaya
- $0.115
- Waktu
- 87.2s
- Token
- 9,629 tok
#19 SpaceXAI: Grok 4.6
high- Biaya
- $0.107
- Waktu
- 265.1s
- Token
- 18,001 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 14.44s | 2,991 | 79 | 6,805 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 102.20s | 9,579 | 379 | 51,829 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 91.77s | 68,548 | 3,931 | 34,529 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 16.08s | 8,937 | 225 | 6,590 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 | |
| Grok 4.6 | 5.3 | 10.0 | 33.3% | 0 | 369.95s | 2,523 | 14 | 154,471 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 19.51s | 1,077 | 56 | 2,448 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 | |
| Grok 4.6 | 9.8 | 10.0 | 100.0% | 0 | 13.82s | 1,857 | 57 | 4,318 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 15.56s | 2,430 | 122 | 5,706 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 13.30s | 8,544 | 216 | 1,505 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 | |
| Grok 4.6 | 3.0 | 10.0 | 0.0% | 0 | 54.22s | 789 | 15 | 8,922 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
GPT-5.5lowvsGrok 4.6highClaude Opus 5.5highvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5lowvsGrok 4.6highGPT-6 AstramediumvsGrok 4.6highClaude Opus 5highvsGemini 3.1 Pro PreviewmediumGPT-5.6 SolmediumvsGrok 4.6highGPT-6 SolmediumvsGrok 4.6highClaude Opus 5.5lowvsGemini 3.1 Pro PreviewmediumGemini 3.7 FlashmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowGemini 3.7 FlashlowvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.6 Solhigh