#256 Grok 4.1 Fast
medium- খরচ
- $0.000
- সময়
- 0.1s
- টোকেন
- 0 tok
সারাংশ
Grok 4.1 Fast AI BENCHY-তে 4.7 স্কোর করে এবং #256 স্থানে আছে। এর reliability 10.0, pass rate 53.0%, মোট খরচ $0.069, এবং গড় response time 23.85s.
Grok 4.1 Fast কে আলাদা করে যা: এটি অ্যান্টি-এআই কৌশল-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর টুল কলিং এর দুর্বলতম ক্ষেত্র, rank #11.
আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।
গবেষণার তারিখ: 2026-08-12
সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।
4.7
ধারাবাহিকতা
6.3
10.0
মোট আউটপুট টোকেন
98,340
মোট ইনপুট টোকেন
42,845
ইনপুট মূল্য
$0.484 / 1M
আউটপুট মূল্য
$0.484 / 1M
অস্থির টেস্ট
6
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
23.85s
প্রতিক্রিয়া সময় (সর্বোচ্চ): 121.79s
প্রতিক্রিয়া সময় (মোট): 286.16s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
রান ইতিহাস
| পরীক্ষিত হয়েছে | স্কোর | নির্ভরযোগ্যতা | সঠিক টেস্ট | মোট খরচ | তুলনা করুন |
|---|---|---|---|---|---|
| 2026-05-08 13:52 পুনরায় পরীক্ষা | 4.7 | 10.0 | $0.069 ↑ | বর্তমান রান | |
| 2026-05-08 13:52 পুনরায় পরীক্ষা | 4.7 | 10.0 | $0.069 ↑ | তুলনা করুন | |
| 2026-05-08 13:52 পুনরায় পরীক্ষা | 6.5 | 10.0 | $0.069 ↑ | তুলনা করুন | |
| 2026-05-08 13:52 পুনরায় পরীক্ষা | 6.5 | 10.0 | $0.058 | তুলনা করুন | |
| 2026-05-08 13:52 স্যুইট পরিবর্তিত হয়েছে | 6.5 | 10.0 | $0.058 | তুলনা করুন | |
| 2026-04-11 01:44 প্রথম নথিভুক্ত রান | 6.7 | প্রযোজ্য নয় | $0.056 | তুলনা করুন |
রান তুলনা
| রান | বেঞ্চমার্ক কভারেজ | স্কোর | ধারাবাহিকতা | নির্ভরযোগ্যতা | সঠিক টেস্ট | অস্থির টেস্ট | মোট আউটপুট টোকেন | মোট ইনপুট টোকেন | মোট খরচ | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-05-08 13:52 · বর্তমান রান | 57/66 প্রচেষ্টা | 4.7 | 6.3 | 10.0 | 9/19 | 6 | 98,340 | 42,845 | $0.069 | 23.85s |
| 2026-04-11 01:44 · প্রথম নথিভুক্ত রান | 54/54 প্রচেষ্টা | 6.7 | 7.2 | প্রযোজ্য নয় | 9/18 | 6 | 93,308 | 0 | $0.056 | 23.88s |
| পার্থক্য | — | -1.9 | -0.9 | 0 | 0 | +5032 | +42845 | +$0.014 | -32ms |
বেঞ্চমার্ক কভারেজ আলাদা: 57/57 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 54/54 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।
এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।
মূল্যের ইতিহাস
OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।
| তারিখ | ইনপুট মূল্য | আউটপুট মূল্য |
|---|---|---|
| 2026-06-04 15:40 | $0.484 / 1M | $0.484 / 1M |
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| অ্যান্টি-এআই কৌশল | 8.7 | 7.9 | |
| কোডিং | 7.8 | 4.0 | |
| সমন্বিত | 5.0 | 5.0 | |
| ডেটা পার্সিং ও নিষ্কাশন | 10.0 | 10.0 | |
| ডোমেইন-নির্দিষ্ট | 5.8 | 4.4 | |
| Sadharon Buddhimotta | 4.2 | 9.9 | |
| নির্দেশনা অনুসরণ | 6.5 | 10.0 | |
| ধাঁধা সমাধান | 5.3 | 7.2 | |
| টুল কলিং | 2.8 | 1.6 | |
| সাধারণ জ্ঞান | 3.0 | 10.0 |