নেভিগেশন
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

LongCat 2.0 (low) average score-এ এগিয়ে: 6.7 vs 6.5. Gemini 3.5 Flash-Lite (medium)-এর benchmark খরচ কম: $0.369 vs $0.391. Gemini 3.5 Flash-Lite (medium) দ্রুত: 6.01s vs 100.31s, pass rates 69.7% vs 53.0%.

প্রস্তাবিত মডেলGemini 3.5 Flash-Lite (medium)Its score stays close to the best score here (6.5 vs 6.7), while responding about 16.7x faster than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium প্রকাশ: 2026-07-21 LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20
স্কোর 6.5 6.7
র‍্যাঙ্ক #104 #96
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 7.4 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 53.0%
অস্থির টেস্ট 7 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.074 3.910
মোট খরচ $0.369 $0.391
ইনপুট মূল্য $0.300 / 1M $0.300 / 1M
আউটপুট মূল্য $2.500 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 118,818 90,909
আউটপুট টোকেন 11,677 5,679
রিজনিং টোকেন 121,611 297,369
প্রতিক্রিয়া সময় (গড়) 6.01s 100.31s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 49.03s 560.39s
প্রতিক্রিয়া সময় (মোট) 132.30s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
খরচ
$0.015
সময়
16.4s
টোকেন
5,971 tok

#96 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

দ্রুত তুলনা

তুলনার জুটি বদলান