নেভিগেশন
AI BENCHY
Advertise here

তুলনা করা মডেল

GPT-5.6 Sol (low) vs Grok 4.6 (high) vs Claude Opus 5 (high) benchmark তুলনা: GPT-5.6 Sol (low) স্কোর-এ 9.5 নিয়ে এগিয়ে। GPT-5.6 Sol (low) নির্ভরযোগ্যতা-এ 10.0 নিয়ে এগিয়ে। GPT-5.6 Sol (low)-এর মোট খরচ সবচেয়ে কম, $0.971. GPT-5.6 Sol (low) 8.79s-এ সবচেয়ে দ্রুত।

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#5
মোট আউটপুট টোকেন
19,246
প্রতিক্রিয়া সময় (গড়)
8.79s
মোট খরচ
$0.971
র‍্যাঙ্ক
#11
মোট আউটপুট টোকেন
265,604
প্রতিক্রিয়া সময় (গড়)
79.38s
মোট খরচ
$1.809
র‍্যাঙ্ক
#10
মোট আউটপুট টোকেন
86,180
প্রতিক্রিয়া সময় (গড়)
20.44s
মোট খরচ
$2.835
প্রস্তাবিত মডেল GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 2.4x less than এই তুলনার অন্য মডেলগুলো.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Sol GPT-5.6 Sol low প্রকাশ: 2026-07-09 Grok 4.6 Grok 4.6 high প্রকাশ: 2026-08-12 Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25
স্কোর 9.5 9.2 9.2
র‍্যাঙ্ক #5 #11 #10
নির্ভরযোগ্যতা 10.0 10.0 10.0
ধারাবাহিকতা 9.2 9.6 9.6
প্রচেষ্টা 66/66 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 86.4% 84.9% 84.9%
অস্থির টেস্ট 2 1 1
মোট রান 66 66 66
প্রতি ফলাফলে খরচ 5.391 10.046 15.747
মোট খরচ $0.971 $1.809 $2.835
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M $5.000 / 1M
আউটপুট মূল্য $30.000 / 1M $6.000 / 1M $25.000 / 1M
মোট ইনপুট টোকেন 78,571 107,266 135,959
আউটপুট টোকেন 4,476 5,094 67,066
রিজনিং টোকেন 14,770 260,510 19,114
প্রতিক্রিয়া সময় (গড়) 8.79s 79.38s 20.44s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 53.91s 618.49s 159.01s
প্রতিক্রিয়া সময় (মোট) 193.33s 1746.29s 449.68s
প্যারামিটার ~2T মোট (~150B সক্রিয়) ~1.7T মোট (~170B সক্রিয়) ~5T মোট (~500B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#5 GPT-5.6 Sol

low
খরচ
$0.062
সময়
26.7s
টোকেন
2,150 tok

#11 SpaceXAI: Grok 4.6

high
খরচ
$0.107
সময়
265.1s
টোকেন
18,001 tok

#10 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721

দ্রুত তুলনা

তুলনার জুটি বদলান