নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs OpenAI: GPT-5.4

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-04

মেট্রিক GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05 GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05
স্কোর 8.4 8.0
র‍্যাঙ্ক #15 #21
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 82.5% 76.2%
অস্থির টেস্ট 4 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 4.932 8.640
মোট খরচ $0.740 $1.210
ইনপুট মূল্য $1.750 / 1M $2.500 / 1M
আউটপুট মূল্য $14.000 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 34,299 34,108
আউটপুট টোকেন 2,357 2,242
রিজনিং টোকেন 46,189 72,707
প্রতিক্রিয়া সময় (গড়) 16.22s 22.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.93s 100.41s
প্রতিক্রিয়া সময় (মোট) 340.67s 469.29s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 606 240 1,722
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 11,019 364 2,731
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 7,140 234 728
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 813 64 25,308
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 477 187 331
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 660 93 693
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.05s 642 356 1,593
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 5,445 254 492
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 195 30 1,701
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

দ্রুত তুলনা

তুলনার জুটি বদলান