नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

LongCat 2.0 (low) average score में आगे है: 6.7 vs 6.5. Gemini 3.5 Flash-Lite (medium) की benchmark लागत कम है: $0.369 vs $0.391. Gemini 3.5 Flash-Lite (medium) तेज है: 6.01s vs 100.31s, pass rates 69.7% vs 53.0%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (medium)Its score stays close to the best score here (6.5 vs 6.7), while responding about 16.7x faster than LongCat 2.0 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium रिलीज़: 2026-07-21 LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20
स्कोर 6.5 6.7
रैंक #104 #96
विश्वसनीयता 10.0 9.6
संगति 7.4 8.9
सही परीक्षण
प्रति प्रयास पास दर 69.7% 53.0%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 3.074 3.910
कुल लागत $0.369 $0.391
इनपुट कीमत $0.300 / 1M $0.300 / 1M
आउटपुट कीमत $2.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 118,818 90,909
आउटपुट टोकन 11,677 5,679
रीजनिंग टोकन 121,611 297,369
प्रतिक्रिया समय (औसत) 6.01s 100.31s
प्रतिक्रिया समय (अधिकतम) 49.03s 560.39s
प्रतिक्रिया समय (कुल) 132.30s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
लागत
$0.015
समय
16.4s
टोकन
5,971 tok

#96 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

त्वरित तुलना

तुलना जोड़ी बदलें