নেভিগেশন
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 6.6. LongCat 2.0 (high)-এর benchmark খরচ কম: $0.469 vs $1.253. GPT-5.5 (low) দ্রুত: 10.13s vs 148.73s, pass rates 53.0% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the best score here (9.3), while responding about 14.7x faster than LongCat 2.0 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক LongCat 2.0 LongCat 2.0 high প্রকাশ: 2026-07-20 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 6.6 9.3
র‍্যাঙ্ক #97 #6
নির্ভরযোগ্যতা 9.4 10.0
ধারাবাহিকতা 8.2 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.0% 86.4%
অস্থির টেস্ট 5 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.202 6.594
মোট খরচ $0.469 $1.253
ইনপুট মূল্য $0.300 / 1M $5.000 / 1M
আউটপুট মূল্য $1.200 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 93,357 80,058
আউটপুট টোকেন 30,466 5,378
রিজনিং টোকেন 336,325 23,040
প্রতিক্রিয়া সময় (গড়) 148.73s 10.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 941.66s 56.19s
প্রতিক্রিয়া সময় (মোট) 3272.00s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

#6 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান