AI BENCHY
Advertise here
#62

GPT-5 Nano

OpenAI প্রকাশ: 2025-08-07 পরীক্ষিত হয়েছে: 2026-04-11 01:44 openai/gpt-5-nano::medium

সারাংশ

GPT-5 Nano AI BENCHY-তে 6.3 স্কোর করে এবং #62 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 59.3%, মোট খরচ $0.066, এবং গড় response time 44.13s.

GPT-5 Nano কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #3; আর ডেটা পার্সিং ও নিষ্কাশন এর দুর্বলতম ক্ষেত্র, rank #15.

ধারাবাহিকতা

6.5

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

161,268

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.050 / 1M

আউটপুট মূল্য

$0.400 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 11

প্রতি চেষ্টায় পাস রেট: 59.3%

অস্থির টেস্ট

8

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

44.13s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 204.02s

প্রতিক্রিয়া সময় (মোট): 485.47s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5 Nano

medium
খরচ
$0.006
সময়
108.5s
টোকেন
13,209 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 13:44 নতুন টেস্ট যোগ হয়েছে 6.3 10.0 $0.081 তুলনা করুন
2026-05-22 00:17 স্যুইট পরিবর্তিত হয়েছে 6.1 10.0 $0.076 তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান 6.3 প্রযোজ্য নয় $0.066 বর্তমান রান

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-11 01:44 · প্রথম নথিভুক্ত রান6.36.5প্রযোজ্য নয়7/188161,2680$0.06644.13s
2026-05-22 00:17 · স্যুইট পরিবর্তিত হয়েছে6.17.110.08/207184,9220$0.07643.11s
পার্থক্য+0.2-0.6-1+1-236540-$0.010+1022ms

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 6.5 7.9
কোডিং 6.7 3.5
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 3.7 1.7
ডোমেইন-নির্দিষ্ট 5.2 4.4
Sadharon Buddhimotta 4.1 10.0
নির্দেশনা অনুসরণ 8.5 6.8
ধাঁধা সমাধান 5.3 7.2
টুল কলিং 10.0 10.0

তুলনা করা মডেল