নেভিগেশন
Advertise here

LongCat 2.0 (low) vs GPT-5.6 Sol

GPT-5.6 Sol average score-এ এগিয়ে: 6.7 vs 6.6. GPT-5.6 Sol-এর benchmark খরচ কম: $0.472 vs $0.495. GPT-5.6 Sol দ্রুত: 4.61s vs 115.00s, pass rates 55.1% vs 60.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#188
মোট আউটপুট টোকেন
346,225
প্রতিক্রিয়া সময় (গড়)
115.00s
মোট খরচ
$0.495
র‍্যাঙ্ক
#183
মোট আউটপুট টোকেন
5,555
প্রতিক্রিয়া সময় (গড়)
4.61s
মোট খরচ
$0.472
প্রস্তাবিত মডেল GPT-5.6 Sol

It has the best score here (6.7), while responding about 25.0x faster than LongCat 2.0 (low).

বিস্তারিত তুলনা

মেট্রিক LongCat 2.0 LongCat 2.0 low প্রকাশ: 2026-07-20 GPT-5.6 Sol GPT-5.6 Sol none প্রকাশ: 2026-07-09
স্কোর 6.6 6.7
র‍্যাঙ্ক #188 #183
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 8.3 9.1
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 55.1% 60.9%
অস্থির টেস্ট 5 3
মোট রান 69 69
প্রতি ফলাফলে খরচ 4.942 6.619
মোট খরচ $0.495 $0.472
ইনপুট মূল্য $0.300 / 1M $2.000 / 1M
আউটপুট মূল্য $1.200 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 262,387 207,852
আউটপুট টোকেন 7,344 5,555
রিজনিং টোকেন 338,881 0
প্রতিক্রিয়া সময় (গড়) 115.00s 4.61s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.39s 58.28s
প্রতিক্রিয়া সময় (মোট) 2645.11s 105.93s
প্যারামিটার 1.6T মোট (48B সক্রিয়) ~2T মোট (~150B সক্রিয়)
উপলভ্যতা উন্মুক্ত উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 LongCat 2.0

low
খরচ
$0.024
সময়
428.0s
টোকেন
19,557 tok

#183 GPT-5.6 Sol

none
খরচ
$0.116
সময়
78.7s
টোকেন
3,944 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

দ্রুত তুলনা

তুলনার জুটি বদলান