নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

average score প্রায় সমান: 6.7 vs 6.7. Gemini 3.5 Flash-Lite (low)-এর benchmark খরচ কম: $0.145 vs $0.391. Gemini 3.5 Flash-Lite (low) দ্রুত: 2.25s vs 100.31s, pass rates 66.7% vs 53.0%.

প্রস্তাবিত মডেলGemini 3.5 Flash-Lite (low)It has the best score here (6.7), while costing about 2.7x less than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite low প্রকাশ: 2026-07-21 LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20
স্কোর 6.7 6.7
র‍্যাঙ্ক #95 #96
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 8.2 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 53.0%
অস্থির টেস্ট 5 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.201 3.910
মোট খরচ $0.145 $0.391
ইনপুট মূল্য $0.300 / 1M $0.300 / 1M
আউটপুট মূল্য $2.500 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 144,622 90,909
আউটপুট টোকেন 15,302 5,679
রিজনিং টোকেন 24,971 297,369
প্রতিক্রিয়া সময় (গড়) 2.25s 100.31s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 13.50s 560.39s
প্রতিক্রিয়া সময় (মোট) 49.58s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.5 Flash-Lite

low
খরচ
$0.008
সময়
7.7s
টোকেন
3,056 tok

#96 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 4.1 7.9 11.1% 1 672ms 8,136 463 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

দ্রুত তুলনা

তুলনার জুটি বদলান