নেভিগেশন
Advertise here

তুলনা করা মডেল

Claude Opus 4.6 (medium) vs Claude Sonnet 4.6 (medium) vs GPT-5.3-Codex (medium) vs Gemini 3.1 Pro Preview (medium) benchmark তুলনা: GPT-5.3-Codex (medium) স্কোর-এ 9.1 নিয়ে এগিয়ে। Claude Opus 4.6 (medium) নির্ভরযোগ্যতা-এ 10.0 নিয়ে এগিয়ে। GPT-5.3-Codex (medium)-এর মোট খরচ সবচেয়ে কম, $1.318. GPT-5.3-Codex (medium) 18.87s-এ সবচেয়ে দ্রুত।

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-06

তুলনা করা মডেল

র‍্যাঙ্ক
#228
মোট আউটপুট টোকেন
96,722
প্রতিক্রিয়া সময় (গড়)
32.23s
মোট খরচ
$2.961
র‍্যাঙ্ক
#212
মোট আউটপুট টোকেন
120,427
প্রতিক্রিয়া সময় (গড়)
28.08s
মোট খরচ
$2.126
র‍্যাঙ্ক
#34
মোট আউটপুট টোকেন
66,287
প্রতিক্রিয়া সময় (গড়)
18.87s
মোট খরচ
$1.318
র‍্যাঙ্ক
#71
মোট আউটপুট টোকেন
102,691
প্রতিক্রিয়া সময় (গড়)
22.71s
মোট খরচ
$1.585
প্রস্তাবিত মডেল GPT-5.3-Codex (medium)

It has the best score here (9.1), while costing about 1.7x less than এই তুলনার অন্য মডেলগুলো.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.6 Claude Opus 4.6 medium প্রকাশ: 2026-02-05 Claude Sonnet 4.6 Claude Sonnet 4.6 medium প্রকাশ: 2026-02-17 GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium প্রকাশ: 2026-02-19
স্কোর 6.3 6.4 9.1 8.4
র‍্যাঙ্ক #228 #212 #34 #71
নির্ভরযোগ্যতা 10.0 10.0 10.0 9.8
ধারাবাহিকতা 8.5 9.1 8.6 9.6
প্রচেষ্টা 66/69 66/69 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.9% 62.3% 84.1% 89.9%
অস্থির টেস্ট 3 1 4 1
মোট রান 66 66 69 69
প্রতি ফলাফলে খরচ 22.777 15.182 7.753 7.924
মোট খরচ $2.961 $2.126 $1.318 $1.585
ইনপুট মূল্য $5.000 / 1M $3.000 / 1M $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $25.000 / 1M $15.000 / 1M $14.000 / 1M $12.000 / 1M
ক্যাশ পড়ার মূল্য $0.500 / 1M $0.300 / 1M $0.175 / 1M $0.200 / 1M
ক্যাশ লেখার মূল্য $6.250 / 1M $3.750 / 1M প্রযোজ্য নয় $0.375 / 1M
মোট ইনপুট টোকেন 108,573 106,316 222,794 176,208
আউটপুট টোকেন 69,994 79,338 7,357 6,093
রিজনিং টোকেন 26,728 41,089 58,930 96,598
প্রতিক্রিয়া সময় (গড়) 32.23s 28.08s 18.87s 22.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 151.51s 140.96s 100.93s 88.68s
প্রতিক্রিয়া সময় (মোট) 515.65s 421.15s 433.94s 386.11s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~1T মোট (~100B সক্রিয়) ~1.2T মোট (~80B সক্রিয়) ~1.2T মোট (~20B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস বন্ধ উৎস বন্ধ উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#228 Claude Opus 4.6

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

#212 Claude Sonnet 4.6

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

#34 GPT-5.3-Codex

medium
খরচ
$0.049
সময়
54.9s
টোকেন
3,580 tok

#71 Gemini 3.1 Pro Preview

medium
খরচ
$0.115
সময়
87.2s
টোকেন
9,629 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247

দ্রুত তুলনা

তুলনার জুটি বদলান