নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs StepFun: Step 3.5 Flash

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-03

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 Step 3.5 Flash Step 3.5 Flash medium প্রকাশ: 2026-02-01
স্কোর 7.9 7.4
র‍্যাঙ্ক #30 #55
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 9.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 73.3% 59.7%
অস্থির টেস্ট 3 1
মোট রান 60 57
প্রতি ফলাফলে খরচ 2.703 0.133
মোট খরচ $0.352 $0.062
ইনপুট মূল্য $1.750 / 1M $0.090 / 1M
আউটপুট মূল্য $14.000 / 1M $0.300 / 1M
মোট ইনপুট টোকেন 31,593 33,555
আউটপুট টোকেন 21,144 90,478
রিজনিং টোকেন 0 173,544
প্রতিক্রিয়া সময় (গড়) 6.82s 43.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 170.45s
প্রতিক্রিয়া সময় (মোট) 136.34s 561.54s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.2 6.7 83.3% 1 8.05s 4,686 4,131 0
Step 3.5 Flash 3.5 7.8 0.0% 0 62.83s 1,335 12,098 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

দ্রুত তুলনা

তুলনার জুটি বদলান