Navigasi
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite vs Qwen3.5-35B-A3B (medium)

Skor rata-rata hampir imbang di 6.1 vs 6.1. Gemini 3.1 Flash Lite memiliki biaya benchmark lebih rendah di $0.046 vs $1.140. Gemini 3.1 Flash Lite lebih cepat di 1.75s vs 110.84s, dengan tingkat keberhasilan 50.0% vs 65.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-20

Peringkat
#173
Total token output
10,723
Waktu respons (rata-rata)
1.75s
Total Biaya
$0.046
Peringkat
#170
Total token output
893,463
Waktu respons (rata-rata)
110.84s
Total Biaya
$1.140
Model yang direkomendasikan Gemini 3.1 Flash Lite

It has the best score here (6.1), while costing about 25.0x less than Qwen3.5-35B-A3B (medium).

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none Rilis: 2026-05-08 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Rilis: 2026-02-24
Skor 6.1 6.1
Peringkat #173 #170
Keandalan 10.0 10.0
Konsistensi 8.6 7.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 50.0% 65.2%
Tes tidak stabil 4 6
Total Run 66 66
Biaya per hasil 0.507 9.806
Total Biaya $0.046 $1.140
Harga input $0.250 / 1M $0.250 / 1M
Harga output $1.500 / 1M $1.250 / 1M
Total token input 118,059 130,450
Token output 10,723 54,857
Token penalaran 0 838,606
Waktu respons (rata-rata) 1.75s 110.84s
Waktu respons (maks) 16.25s 950.25s
Waktu respons (total) 38.42s 2438.58s
Parameter ~150B total (~10B aktif) 35B total (3B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 Gemini 3.1 Flash Lite

none
Biaya
$0.001
Waktu
4.5s
Token
727 tok

#170 Qwen3.5-35B-A3B

medium
Biaya
$0.009
Waktu
71.4s
Token
8,631 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 938ms 8,128 666 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

Perbandingan Cepat

Ganti Pasangan Perbandingan