Navigasi
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite Preview (medium) vs Qwen3.7 Max

Skor rata-rata hampir imbang di 7.4 vs 7.4. Gemini 3.1 Flash Lite Preview (medium) memiliki biaya benchmark lebih rendah di $0.117 vs $0.197. Qwen3.7 Max lebih cepat di 4.56s vs 4.59s, dengan tingkat keberhasilan 63.6% vs 68.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-29

Peringkat
#91
Total token output
57,778
Waktu respons (rata-rata)
4.59s
Total Biaya
$0.117
Peringkat
#92
Total token output
12,446
Waktu respons (rata-rata)
4.56s
Total Biaya
$0.197
Model yang direkomendasikan Gemini 3.1 Flash Lite Preview (medium)

It has the best score here (7.4), while costing about 1.7x less than Qwen3.7 Max.

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Rilis: 2026-03-03 Qwen3.7 Max Qwen3.7 Max none Rilis: 2026-05-22
Skor 7.4 7.4
Peringkat #91 #92
Keandalan 10.0 9.9
Konsistensi 9.9 10.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 63.6% 68.2%
Tes tidak stabil 0 0
Total Run 66 66
Biaya per hasil 0.829 1.581
Total Biaya $0.117 $0.197
Harga input $0.250 / 1M $1.475 / 1M
Harga output $1.500 / 1M $4.425 / 1M
Total token input 117,493 95,992
Token output 10,589 12,446
Token penalaran 47,189 0
Waktu respons (rata-rata) 4.59s 4.56s
Waktu respons (maks) 18.34s 72.30s
Waktu respons (total) 101.04s 100.30s
Parameter ~150B total (~10B aktif) ~1T total (~40B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Gemini 3.1 Flash Lite Preview

medium
Biaya
$0.003
Waktu
5.2s
Token
1,944 tok

#92 Qwen3.7 Max

none
Biaya
$0.046
Waktu
195.0s
Token
12,171 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 4.09s 8,126 461 8,597
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

Perbandingan Cepat

Ganti Pasangan Perbandingan