নেভিগেশন
Advertise here

GPT-5.3-Codex (medium) vs Pareto

average score প্রায় সমান: 8.9 vs 8.9. GPT-5.3-Codex (medium)-এর benchmark খরচ কম: $0.988 vs $1.172. GPT-5.3-Codex (medium) দ্রুত: 16.91s vs 31.51s, pass rates 83.3% vs 86.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-18

তুলনা করা মডেল

র‍্যাঙ্ক
#32
মোট আউটপুট টোকেন
60,374
প্রতিক্রিয়া সময় (গড়)
16.91s
মোট খরচ
$0.988
র‍্যাঙ্ক
#34
মোট আউটপুট টোকেন
119,230
প্রতিক্রিয়া সময় (গড়)
31.51s
মোট খরচ
$1.172
প্রস্তাবিত মডেল GPT-5.3-Codex (medium)

It has the best score here (8.9), while responding about 1.9x faster than Pareto.

বিস্তারিত তুলনা

মেট্রিক GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05 Pareto Pareto none প্রকাশ: 2026-09-18
স্কোর 8.9 8.9
র‍্যাঙ্ক #32 #34
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 86.4%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.171 6.506
মোট খরচ $0.988 $1.172
ইনপুট মূল্য $1.750 / 1M $2.500 / 1M
আউটপুট মূল্য $14.000 / 1M $7.500 / 1M
মোট ইনপুট টোকেন 81,187 110,734
আউটপুট টোকেন 6,258 119,230
রিজনিং টোকেন 54,116 0
প্রতিক্রিয়া সময় (গড়) 16.91s 31.51s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.93s 143.33s
প্রতিক্রিয়া সময় (মোট) 372.03s 693.29s
প্যারামিটার ~1.2T মোট (~80B সক্রিয়) -
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 GPT-5.3-Codex

medium
খরচ
$0.049
সময়
54.9s
টোকেন
3,580 tok

#34 Pareto

none
খরচ
$0.034
সময়
170.7s
টোকেন
4,581 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Pareto 10.0 10.0 100.0% 0 50.12s 7,471 1,949 0

দ্রুত তুলনা

তুলনার জুটি বদলান