Navigasi
AI BENCHY
Advertise here

Google: Gemini 3.1 Flash Lite vs Meituan: LongCat 2.0

LongCat 2.0 unggul dalam skor rata-rata dengan 6.3 vs 6.1. LongCat 2.0 memiliki biaya benchmark lebih rendah di $0.044 vs $0.047. Gemini 3.1 Flash Lite (minimal) lebih cepat di 1.86s vs 5.18s, dengan tingkat keberhasilan 51.5% vs 36.4%.

Model yang direkomendasikanGemini 3.1 Flash Lite (minimal)Its score stays close to the best score here (6.1 vs 6.3), while responding about 2.8x faster than LongCat 2.0.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-20

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Rilis: 2026-05-08 LongCat 2.0 LongCat 2.0 none Rilis: 2026-07-20
Skor 6.1 6.3
Peringkat #120 #111
Keandalan 10.0 10.0
Konsistensi 8.9 9.3
Tes benar
Tingkat lulus per percobaan 51.5% 36.4%
Tes tidak stabil 3 2
Total Run 66 66
Biaya per hasil 0.465 0.627
Total Biaya $0.047 $0.044
Harga input $0.250 / 1M $0.300 / 1M
Harga output $1.500 / 1M $1.200 / 1M
Total token input 119,065 108,743
Token output 11,118 9,372
Token penalaran 0 0
Waktu respons (rata-rata) 1.86s 5.18s
Waktu respons (maks) 12.97s 48.38s
Waktu respons (total) 40.88s 113.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Gemini 3.1 Flash Lite

minimal
Biaya
$0.001
Waktu
3.7s
Token
635 tok

#111 LongCat 2.0

none
Biaya
$0.027
Waktu
411.7s
Token
22,283 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

Perbandingan Cepat

Ganti Pasangan Perbandingan