- স্কোর
- 7.5 (+1.81 পয়েন্ট)
- মোট খরচ (বর্তমান মূল্য)
- $0.000 · 100.0% সস্তা
- প্রতিক্রিয়া সময় (গড়)
- 29.38s · 48.0% দ্রুত
সারাংশ
GPT-5 Nano AI BENCHY-তে 5.7 স্কোর করে এবং #260 স্থানে আছে। এর reliability 10.0, pass rate 53.6%, মোট খরচ $0.159, এবং গড় response time 56.55s.
GPT-5 Nano কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর ডেটা পার্সিং ও নিষ্কাশন এর দুর্বলতম ক্ষেত্র, rank #17.
প্রস্তাবিত বিকল্প
এর বদলে এই মডেলগুলির একটি বেছে নেওয়ার পরামর্শ দিই:
- স্কোর
- 8.1 (+2.33 পয়েন্ট)
- মোট খরচ (বর্তমান মূল্য)
- $0.020 · 87.5% সস্তা
- প্রতিক্রিয়া সময় (গড়)
- 55.99s · 1.0% দ্রুত
- স্কোর
- 8.3 (+2.53 পয়েন্ট)
- মোট খরচ (বর্তমান মূল্য)
- $0.047 · 70.4% সস্তা
- প্রতিক্রিয়া সময় (গড়)
- 18.07s · 68.1% দ্রুত
মডেলের তথ্য
গবেষণার তারিখ: 2026-08-12
- প্যারামিটার
- ~120B মোট (~5B সক্রিয়)
- আর্কিটেকচার
- MoE
- উপলভ্যতা
- বন্ধ উৎস
- লাইসেন্স
- -
সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।
5.7
ধারাবাহিকতা
6.5
10.0
মোট আউটপুট টোকেন
307,921
মোট ইনপুট টোকেন
314,436
ইনপুট মূল্য
$0.050 / 1M
আউটপুট মূল্য
$0.400 / 1M
ক্যাশ পড়ার মূল্য
$0.005 / 1M
ক্যাশ লেখার মূল্য
প্রযোজ্য নয়
ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।
অস্থির টেস্ট
10
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
56.55s
প্রতিক্রিয়া সময় (সর্বোচ্চ): 227.89s
প্রতিক্রিয়া সময় (মোট): 961.32s
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#260 GPT-5 Nano
medium- খরচ
- $0.006
- সময়
- 108.5s
- টোকেন
- 13,209 tok
রান ইতিহাস
| পরীক্ষিত হয়েছে | স্কোর | নির্ভরযোগ্যতা | সঠিক টেস্ট | মোট খরচ | তুলনা করুন |
|---|---|---|---|---|---|
| 2026-10-01 01:31 পুনরায় পরীক্ষা | 5.7 | 10.0 | $0.159 ↑ | বর্তমান রান | |
| 2026-07-16 22:32 নতুন টেস্ট যোগ হয়েছে | 6.1 | 10.0 | $0.114 | তুলনা করুন | |
| 2026-06-04 13:44 নতুন টেস্ট যোগ হয়েছে | 6.3 | 10.0 | $0.081 | তুলনা করুন | |
| 2026-05-22 00:17 স্যুইট পরিবর্তিত হয়েছে | 6.1 | 10.0 | $0.076 | তুলনা করুন | |
| 2026-04-11 01:44 প্রথম নথিভুক্ত রান | 6.3 | প্রযোজ্য নয় | $0.066 | তুলনা করুন |
এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।
রান তুলনা
| রান | বেঞ্চমার্ক কভারেজ | স্কোর | ধারাবাহিকতা | নির্ভরযোগ্যতা | সঠিক টেস্ট | অস্থির টেস্ট | মোট আউটপুট টোকেন | মোট ইনপুট টোকেন | মোট খরচ | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 01:31 · বর্তমান রান | 69/69 প্রচেষ্টা | 5.7 | 6.5 | 10.0 | 8/23 | 10 | 307,921 | 314,436 | $0.159 | 56.55s |
| 2026-07-16 22:32 · নতুন টেস্ট যোগ হয়েছে | 66/66 প্রচেষ্টা | 6.1 | 7.0 | 10.0 | 9/22 | 8 | 273,098 | 94,935 | $0.114 | 54.87s |
| পার্থক্য | — | -0.3 | -0.5 | 0.0 | -1 | +2 | +34823 | +219501 | +$0.045 | +1683ms |
বেঞ্চমার্ক কভারেজ আলাদা: 69/69 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 66/66 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।
এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।
মূল্যের ইতিহাস
OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।
| তারিখ | ইনপুট মূল্য | আউটপুট মূল্য | ক্যাশ পড়ার মূল্য | ক্যাশ লেখার মূল্য |
|---|---|---|---|---|
| 2026-08-14 12:51 | $0.050 / 1M | $0.400 / 1M | প্রযোজ্য নয় | প্রযোজ্য নয় |
| 2026-10-01 18:33 | $0.050 / 1M | $0.400 / 1M | $0.005 / 1M | প্রযোজ্য নয় |
চার্ট
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর vs মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
দ্রুত তুলনা
বিভাগভিত্তিক বিশ্লেষণ
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| স্বায়ত্তশাসিত এজেন্টের কাজ | 4.7 | 3.1 | |
| অ্যান্টি-এআই কৌশল | 6.5 | 7.9 | |
| কোডিং | 7.0 | 7.7 | |
| সমন্বিত | 6.4 | 5.8 | |
| ডেটা পার্সিং ও নিষ্কাশন | 3.7 | 1.7 | |
| ডোমেইন-নির্দিষ্ট | 3.4 | 1.6 | |
| Sadharon Buddhimotta | 4.1 | 10.0 | |
| নির্দেশনা অনুসরণ | 9.8 | 10.0 | |
| ধাঁধা সমাধান | 5.3 | 7.2 | |
| টুল কলিং | 10.0 | 10.0 | |
| সাধারণ জ্ঞান | 3.0 | 10.0 |