নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.2 vs StepFun: Step 3.7 Flash

সারাংশ

GPT-5.2 vs Step 3.7 Flash benchmark তুলনা: Step 3.7 Flash average score-এ এগিয়ে: 8.5 vs 8.4. Step 3.7 Flash-এর benchmark খরচ কম: $0.376 vs $0.548. GPT-5.2 দ্রুত: 16.88s vs 20.35s, pass rates 71.4% vs 73.0%.

প্রস্তাবিত মডেল: Step 3.7 Flash - It has the strongest score in this comparison (8.5) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-02

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Step 3.7 Flash Step 3.7 Flash medium প্রকাশ: 2026-05-29
স্কোর 8.4 8.5
র‍্যাঙ্ক #22 #20
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.4 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.4% 73.0%
অস্থির টেস্ট 4 2
মোট রান 63 61
প্রতি ফলাফলে খরচ 4.209 2.686
মোট খরচ $0.548 $0.376
ইনপুট মূল্য $1.750 / 1M $0.200 / 1M
আউটপুট মূল্য $14.000 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 33,967 39,981
আউটপুট টোকেন 2,901 319,958
রিজনিং টোকেন 31,932 0
প্রতিক্রিয়া সময় (গড়) 16.88s 20.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 77.80s 113.98s
প্রতিক্রিয়া সময় (মোট) 236.34s 427.42s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#20 Step 3.7 Flash

medium
খরচ
$0.006
সময়
46.2s
টোকেন
4,466 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 6.5 8.0 58.3% 1 7.81s 606 567 2,002
Step 3.7 Flash 8.7 7.9 91.7% 1 9.65s 756 32,185 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Step 3.7 Flash 8.8 7.8 88.9% 1 27.42s 7,437 44,797 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 14.06s 11,019 291 1,757
Step 3.7 Flash 10.0 10.0 100.0% 0 9.06s 13,683 7,106 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 3.15s 7,140 234 420
Step 3.7 Flash 10.0 10.0 100.0% 0 2.75s 7,398 3,020 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 5.9 7.2 55.6% 1 77.80s 473 42 10,342
Step 3.7 Flash 7.7 10.0 66.7% 0 48.27s 708 70,347 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 3.7 9.7 0.0% 0 4.32s 477 162 269
Step 3.7 Flash 4.0 10.0 0.0% 0 6.85s 525 3,987 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 9.9 10.0 100.0% 0 3.12s 660 94 614
Step 3.7 Flash 9.8 10.0 100.0% 0 1.83s 735 2,166 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 7.5 7.3 77.8% 1 5.80s 642 735 924
Step 3.7 Flash 5.7 9.9 33.3% 0 6.19s 756 15,071 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 4.7 1.6 66.7% 1 10.30s 5,453 239 469
Step 3.7 Flash 10.0 10.0 100.0% 0 4.16s 7,746 2,115 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 3.0 10.0 0.0% 0 28.18s 195 26 3,223
Step 3.7 Flash 3.0 10.0 0.0% 0 113.98s 237 139,164 0

দ্রুত তুলনা

তুলনার জুটি বদলান