Advertise here
#73

Grok 4.7

X AI প্রকাশ: 2026-09-21 পরীক্ষিত হয়েছে: 2026-09-21 22:08 x-ai/grok-4.7::medium
~1.7T মোট (~170B সক্রিয়)MoEবন্ধ উৎসআনুমানিক
(xhigh) (high) (medium) (low)

সারাংশ

Grok 4.7 AI BENCHY-তে 8.1 স্কোর করে এবং #73 স্থানে আছে। এর reliability 9.9, pass rate 81.8%, মোট খরচ $2.254, এবং গড় response time 106.09s.

Grok 4.7 কে আলাদা করে যা: এটি ধাঁধা সমাধান-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর কোডিং এর দুর্বলতম ক্ষেত্র, rank #15.

মডেলের তথ্য

গবেষণার তারিখ: 2026-09-21

আনুমানিক
প্যারামিটার
~1.7T মোট (~170B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

8.3

মোট আউটপুট টোকেন

433,733

মোট ইনপুট টোকেন

107,193

ইনপুট মূল্য

$1.600 / 1M

আউটপুট মূল্য

$4.800 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 7

প্রতি চেষ্টায় পাস রেট: 81.8%

অস্থির টেস্ট

5

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

106.09s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 660.89s

প্রতিক্রিয়া সময় (মোট): 2333.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 SpaceXAI: Grok 4.7

medium
খরচ
$0.047
সময়
132.3s
টোকেন
9,954 tok

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 10.0 10.0
কোডিং 6.6 4.6
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 7.2
Sadharon Buddhimotta 5.4 2.5
নির্দেশনা অনুসরণ 8.4 6.9
ধাঁধা সমাধান 10.0 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল