नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

LongCat 2.0 (low) average score मध्ये पुढे आहे: 6.7 vs 6.5. Gemini 3.5 Flash-Lite (medium) चा benchmark खर्च कमी आहे: $0.369 vs $0.391. Gemini 3.5 Flash-Lite (medium) वेगवान आहे: 6.01s vs 100.31s, pass rates 69.7% vs 53.0%.

शिफारस केलेले मॉडेलGemini 3.5 Flash-Lite (medium)Its score stays close to the best score here (6.5 vs 6.7), while responding about 16.7x faster than LongCat 2.0 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium प्रकाशन: 2026-07-21 LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20
स्कोअर 6.5 6.7
क्रमांक #104 #96
विश्वसनीयता 10.0 9.6
सुसंगतता 7.4 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 53.0%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 3.074 3.910
एकूण खर्च $0.369 $0.391
इनपुट किंमत $0.300 / 1M $0.300 / 1M
आउटपुट किंमत $2.500 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 118,818 90,909
आउटपुट टोकन्स 11,677 5,679
रिझनिंग टोकन्स 121,611 297,369
प्रतिसाद वेळ (सरासरी) 6.01s 100.31s
प्रतिसाद वेळ (कमाल) 49.03s 560.39s
प्रतिसाद वेळ (एकूण) 132.30s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
खर्च
$0.015
वेळ
16.4s
टोकन्स
5,971 tok

#96 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

झटपट तुलना

तुलना जोडी बदला