নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 average score-এ এগিয়ে: 6.9 vs 6.7. LongCat 2.0 (low)-এর benchmark খরচ কম: $0.391 vs $0.544. GPT-5.5 দ্রুত: 2.36s vs 100.31s, pass rates 53.0% vs 56.1%.

প্রস্তাবিত মডেলGPT-5.5It has the best score here (6.9), while responding about 42.5x faster than LongCat 2.0 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24
স্কোর 6.7 6.9
র‍্যাঙ্ক #91 #87
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 56.1%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 3.910 4.945
মোট খরচ $0.391 $0.544
ইনপুট মূল্য $0.300 / 1M $5.000 / 1M
আউটপুট মূল্য $1.200 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 90,909 79,285
আউটপুট টোকেন 5,679 4,915
রিজনিং টোকেন 297,369 0
প্রতিক্রিয়া সময় (গড়) 100.31s 2.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 12.24s
প্রতিক্রিয়া সময় (মোট) 2206.82s 51.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#87 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

দ্রুত তুলনা

তুলনার জুটি বদলান