नेविगेशन
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

LongCat 2.0 (high) average score में आगे है: 6.6 vs 6.5. Gemini 3.5 Flash-Lite (medium) की benchmark लागत कम है: $0.369 vs $0.469. Gemini 3.5 Flash-Lite (medium) तेज है: 6.01s vs 148.73s, pass rates 69.7% vs 53.0%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (medium)Its score stays close to the best score here (6.5 vs 6.6), while responding about 24.7x faster than LongCat 2.0 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium रिलीज़: 2026-07-21 LongCat 2.0 LongCat 2.0 high रिलीज़: 2026-07-20
स्कोर 6.5 6.6
रैंक #104 #102
विश्वसनीयता 10.0 9.4
संगति 7.4 8.2
सही परीक्षण
प्रति प्रयास पास दर 69.7% 53.0%
अस्थिर टेस्ट 7 5
कुल रन 66 66
प्रति परिणाम लागत 3.074 5.202
कुल लागत $0.369 $0.469
इनपुट कीमत $0.300 / 1M $0.300 / 1M
आउटपुट कीमत $2.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 118,818 93,357
आउटपुट टोकन 11,677 30,466
रीजनिंग टोकन 121,611 336,325
प्रतिक्रिया समय (औसत) 6.01s 148.73s
प्रतिक्रिया समय (अधिकतम) 49.03s 941.66s
प्रतिक्रिया समय (कुल) 132.30s 3272.00s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
लागत
$0.015
समय
16.4s
टोकन
5,971 tok

#102 LongCat 2.0

high
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377

त्वरित तुलना

तुलना जोड़ी बदलें