नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

average score लगभग बराबर है: 6.7 vs 6.7. Gemini 3.5 Flash-Lite (low) की benchmark लागत कम है: $0.145 vs $0.391. Gemini 3.5 Flash-Lite (low) तेज है: 2.25s vs 100.31s, pass rates 66.7% vs 53.0%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (low)It has the best score here (6.7), while costing about 2.7x less than LongCat 2.0 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite low रिलीज़: 2026-07-21 LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20
स्कोर 6.7 6.7
रैंक #95 #96
विश्वसनीयता 10.0 9.6
संगति 8.2 8.9
सही परीक्षण
प्रति प्रयास पास दर 66.7% 53.0%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 1.201 3.910
कुल लागत $0.145 $0.391
इनपुट कीमत $0.300 / 1M $0.300 / 1M
आउटपुट कीमत $2.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 144,622 90,909
आउटपुट टोकन 15,302 5,679
रीजनिंग टोकन 24,971 297,369
प्रतिक्रिया समय (औसत) 2.25s 100.31s
प्रतिक्रिया समय (अधिकतम) 13.50s 560.39s
प्रतिक्रिया समय (कुल) 49.58s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.5 Flash-Lite

low
लागत
$0.008
समय
7.7s
टोकन
3,056 tok

#96 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 4.1 7.9 11.1% 1 672ms 8,136 463 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

त्वरित तुलना

तुलना जोड़ी बदलें