AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#106

Grok 4.7

X AI প্রকাশ: 2026-09-21 পরীক্ষিত হয়েছে: 2026-09-21 22:00 x-ai/grok-4.7::xhigh
~1.7T মোট (~170B সক্রিয়)MoEবন্ধ উৎসআনুমানিক

সারাংশ

Grok 4.7 AI BENCHY-তে 7.5 স্কোর করে এবং #106 স্থানে আছে। এর reliability 9.6, pass rate 77.3%, মোট খরচ $2.625, এবং গড় response time 115.74s.

Grok 4.7 কে আলাদা করে যা: এটি অ্যান্টি-এআই কৌশল-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #3; আর কোডিং এর দুর্বলতম ক্ষেত্র, rank #16. এটি অস্বাভাবিকভাবে বেশি reasoning tokens ব্যবহার করে, যা ধীর বা বেশি খরচের runs ব্যাখ্যা করতে পারে।

মডেলের তথ্য

গবেষণার তারিখ: 2026-09-21

আনুমানিক
প্যারামিটার
~1.7T মোট (~170B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

7.7

মোট আউটপুট টোকেন

505,069

মোট ইনপুট টোকেন

124,896

ইনপুট মূল্য

$1.600 / 1M

আউটপুট মূল্য

$4.800 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 8

প্রতি চেষ্টায় পাস রেট: 77.3%

অস্থির টেস্ট

6

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

115.74s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 775.64s

প্রতিক্রিয়া সময় (মোট): 2546.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 SpaceXAI: Grok 4.7

xhigh
খরচ
$0.235
সময়
544.2s
টোকেন
39,247 tok

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 8.7 7.9
কোডিং 5.3 4.5
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 3.5 4.4
Sadharon Buddhimotta 4.7 1.6
নির্দেশনা অনুসরণ 9.8 10.0
ধাঁধা সমাধান 10.0 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল