AI BENCHY
Advertise here
#57

GPT-5.2

OpenAI প্রকাশ: 2025-12-11 পরীক্ষিত হয়েছে: 2026-05-22 00:19 openai/gpt-5.2::medium

সারাংশ

GPT-5.2 AI BENCHY-তে 7.4 স্কোর করে এবং #57 স্থানে আছে। এর reliability 10.0, pass rate 70.0%, মোট খরচ $0.490, এবং গড় response time 16.44s.

GPT-5.2 কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর Sadharon Buddhimotta এর দুর্বলতম ক্ষেত্র, rank #13.

ধারাবাহিকতা

8.3

মোট আউটপুট টোকেন

31,057

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$1.750 / 1M

আউটপুট মূল্য

$14.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 8

প্রতি চেষ্টায় পাস রেট: 70.0%

অস্থির টেস্ট

4

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

16.44s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 77.80s

প্রতিক্রিয়া সময় (মোট): 213.77s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:45 নতুন টেস্ট যোগ হয়েছে 7.5 10.0 $0.548 তুলনা করুন
2026-05-22 00:19 পুনরায় পরীক্ষা 7.4 10.0 $0.490 বর্তমান রান
2026-04-11 01:44 প্রথম নথিভুক্ত রান 7.5 প্রযোজ্য নয় $0.352 তুলনা করুন

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 6.5 8.0
কোডিং 10.0 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.9 7.2
Sadharon Buddhimotta 3.7 9.7
নির্দেশনা অনুসরণ 9.9 10.0
ধাঁধা সমাধান 7.6 7.3
টুল কলিং 4.7 1.6
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল