Navigasi
AI BENCHY
Advertise here

Google: Gemini 3.1 Flash Lite Preview vs Meituan: LongCat 2.0

Gemini 3.1 Flash Lite Preview (low) unggul dalam skor rata-rata dengan 6.5 vs 6.3. LongCat 2.0 memiliki biaya benchmark lebih rendah di $0.044 vs $0.646. LongCat 2.0 lebih cepat di 5.18s vs 16.70s, dengan tingkat keberhasilan 59.1% vs 36.4%.

Model yang direkomendasikanGemini 3.1 Flash Lite Preview (low)It has the strongest score in this comparison (6.5) and the best overall balance of cost and response time across all 2 models.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-20

Metrik Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Rilis: 2026-03-03 LongCat 2.0 LongCat 2.0 none Rilis: 2026-07-20
Skor 6.5 6.3
Peringkat #104 #111
Keandalan 10.0 10.0
Konsistensi 10.0 9.3
Tes benar
Tingkat lulus per percobaan 59.1% 36.4%
Tes tidak stabil 0 2
Total Run 66 66
Biaya per hasil 4.969 0.627
Total Biaya $0.646 $0.044
Harga input $0.250 / 1M $0.300 / 1M
Harga output $1.500 / 1M $1.200 / 1M
Total token input 110,185 108,743
Token output 14,717 9,372
Token penalaran 397,483 0
Waktu respons (rata-rata) 16.70s 5.18s
Waktu respons (maks) 309.35s 48.38s
Waktu respons (total) 367.47s 113.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.1 Flash Lite Preview

low
Biaya
$0.002
Waktu
3.7s
Token
1,203 tok

#111 LongCat 2.0

none
Biaya
$0.027
Waktu
411.7s
Token
22,283 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 1.39s 8,138 660 1,060
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

Perbandingan Cepat

Ganti Pasangan Perbandingan