नेव्हिगेशन
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

average score जवळपास समान आहे: 6.7 vs 6.7. Gemini 3.5 Flash-Lite (low) चा benchmark खर्च कमी आहे: $0.145 vs $0.391. Gemini 3.5 Flash-Lite (low) वेगवान आहे: 2.25s vs 100.31s, pass rates 66.7% vs 53.0%.

शिफारस केलेले मॉडेलGemini 3.5 Flash-Lite (low)It has the best score here (6.7), while costing about 2.7x less than LongCat 2.0 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite low प्रकाशन: 2026-07-21 LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20
स्कोअर 6.7 6.7
क्रमांक #95 #96
विश्वसनीयता 10.0 9.6
सुसंगतता 8.2 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 53.0%
अस्थिर चाचण्या 5 3
एकूण रन 66 66
प्रति निकाल खर्च 1.201 3.910
एकूण खर्च $0.145 $0.391
इनपुट किंमत $0.300 / 1M $0.300 / 1M
आउटपुट किंमत $2.500 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 144,622 90,909
आउटपुट टोकन्स 15,302 5,679
रिझनिंग टोकन्स 24,971 297,369
प्रतिसाद वेळ (सरासरी) 2.25s 100.31s
प्रतिसाद वेळ (कमाल) 13.50s 560.39s
प्रतिसाद वेळ (एकूण) 49.58s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.5 Flash-Lite

low
खर्च
$0.008
वेळ
7.7s
टोकन्स
3,056 tok

#96 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash-Lite 4.1 7.9 11.1% 1 672ms 8,136 463 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

झटपट तुलना

तुलना जोडी बदला