Navigasi
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (medium) vs Grok 4.6 (low)

Grok 4.6 (low) unggul dalam skor rata-rata dengan 7.4 vs 7.3. Gemini 3.1 Flash Lite (medium) memiliki biaya benchmark lebih rendah di $0.117 vs $0.441. Gemini 3.1 Flash Lite (medium) lebih cepat di 4.27s vs 14.20s, dengan tingkat keberhasilan 62.1% vs 71.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-12

Peringkat
#96
Total token output
60,298
Waktu respons (rata-rata)
4.27s
Total Biaya
$0.117
Peringkat
#90
Total token output
36,792
Waktu respons (rata-rata)
14.20s
Total Biaya
$0.441
Model yang direkomendasikan Gemini 3.1 Flash Lite (medium)

Its score stays close to the best score here (7.3 vs 7.4), while costing about 3.8x less than Grok 4.6 (low).

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Rilis: 2026-05-08 Grok 4.6 Grok 4.6 low Rilis: 2026-08-12
Skor 7.3 7.4
Peringkat #96 #90
Keandalan 10.0 10.0
Konsistensi 9.2 9.2
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 62.1% 71.2%
Tes tidak stabil 2 2
Total Run 66 66
Biaya per hasil 0.898 2.938
Total Biaya $0.117 $0.441
Harga input $0.250 / 1M $2.000 / 1M
Harga output $1.500 / 1M $6.000 / 1M
Total token input 104,918 109,951
Token output 9,168 5,124
Token penalaran 51,130 31,668
Waktu respons (rata-rata) 4.27s 14.20s
Waktu respons (maks) 26.22s 26.46s
Waktu respons (total) 94.02s 312.33s
Parameter ~150B total (~10B aktif) ~1.7T total (~170B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 Gemini 3.1 Flash Lite

medium
Biaya
$0.003
Waktu
5.3s
Token
1,754 tok

#90 SpaceXAI: Grok 4.6

low
Biaya
$0.011
Waktu
26.0s
Token
1,941 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

Perbandingan Cepat

Ganti Pasangan Perbandingan