Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.1 Flash Lite (low) vs LongCat 2.0

Skor rata-rata hampir imbang di 6.3 vs 6.4. LongCat 2.0 memiliki biaya benchmark lebih rendah di $0.104 vs $0.717. LongCat 2.0 lebih cepat di 8.50s vs 19.02s, dengan tingkat keberhasilan 60.9% vs 42.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#218
Total token output
425,576
Waktu respons (rata-rata)
19.02s
Total Biaya
$0.717
Peringkat
#212
Total token output
17,473
Waktu respons (rata-rata)
8.50s
Total Biaya
$0.104
Model yang direkomendasikan LongCat 2.0

It has the best score here (6.4), while costing about 6.9x less than Gemini 3.1 Flash Lite (low).

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Rilis: 2026-05-08 LongCat 2.0 LongCat 2.0 none Rilis: 2026-07-20
Skor 6.3 6.4
Peringkat #218 #212
Keandalan 10.0 10.0
Konsistensi 9.3 9.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 60.9% 42.0%
Tes tidak stabil 2 3
Total Run 69 69
Biaya per hasil 5.512 1.298
Total Biaya $0.717 $0.104
Harga input $0.250 / 1M $0.300 / 1M
Harga output $1.500 / 1M $1.200 / 1M
Total token input 312,368 276,199
Token output 9,429 17,473
Token penalaran 416,147 0
Waktu respons (rata-rata) 19.02s 8.50s
Waktu respons (maks) 318.02s 81.77s
Waktu respons (total) 437.38s 195.60s
Parameter ~150B total (~10B aktif) 1.6T total (48B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#218 Gemini 3.1 Flash Lite

low
Biaya
$0.003
Waktu
4.0s
Token
1,479 tok

#212 LongCat 2.0

none
Biaya
$0.027
Waktu
411.7s
Token
22,283 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

Perbandingan Cepat

Ganti Pasangan Perbandingan