नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

Gemini 3.5 Flash-Lite (medium) average score मध्ये पुढे आहे: 6.5 vs 6.3. LongCat 2.0 चा benchmark खर्च कमी आहे: $0.044 vs $0.369. LongCat 2.0 वेगवान आहे: 5.18s vs 6.01s, pass rates 69.7% vs 36.4%.

शिफारस केलेले मॉडेलLongCat 2.0Its score stays close to the best score here (6.3 vs 6.5), while costing about 8.4x less than Gemini 3.5 Flash-Lite (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium प्रकाशन: 2026-07-21 LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20
स्कोअर 6.5 6.3
क्रमांक #104 #117
विश्वसनीयता 10.0 10.0
सुसंगतता 7.4 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 36.4%
अस्थिर चाचण्या 7 2
एकूण रन 66 66
प्रति निकाल खर्च 3.074 0.627
एकूण खर्च $0.369 $0.044
इनपुट किंमत $0.300 / 1M $0.300 / 1M
आउटपुट किंमत $2.500 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 118,818 108,743
आउटपुट टोकन्स 11,677 9,372
रिझनिंग टोकन्स 121,611 0
प्रतिसाद वेळ (सरासरी) 6.01s 5.18s
प्रतिसाद वेळ (कमाल) 49.03s 48.38s
प्रतिसाद वेळ (एकूण) 132.30s 113.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
खर्च
$0.015
वेळ
16.4s
टोकन्स
5,971 tok

#117 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

झटपट तुलना

तुलना जोडी बदला