নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 6.7. LongCat 2.0 (low)-এর benchmark খরচ কম: $0.391 vs $1.253. GPT-5.5 (low) দ্রুত: 10.13s vs 100.31s, pass rates 53.0% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the best score here (9.3), while responding about 9.9x faster than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 6.7 9.3
র‍্যাঙ্ক #91 #6
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 86.4%
অস্থির টেস্ট 3 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.910 6.594
মোট খরচ $0.391 $1.253
ইনপুট মূল্য $0.300 / 1M $5.000 / 1M
আউটপুট মূল্য $1.200 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 90,909 80,058
আউটপুট টোকেন 5,679 5,378
রিজনিং টোকেন 297,369 23,040
প্রতিক্রিয়া সময় (গড়) 100.31s 10.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 56.19s
প্রতিক্রিয়া সময় (মোট) 2206.82s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#6 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান