AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#96

Nemotron 3 Super

NVIDIA প্রকাশ: 2026-03-11 পরীক্ষিত হয়েছে: 2026-05-22 00:27 nvidia/nemotron-3-super-120b-a12b::medium
120B মোট (12B সক্রিয়)MoEওজন উপলভ্য
(medium) (none)

সারাংশ

Nemotron 3 Super AI BENCHY-তে 5.9 স্কোর করে এবং #96 স্থানে আছে। এর reliability 10.0, pass rate 45.0%, মোট খরচ $0.001, এবং গড় response time 21.15s.

Nemotron 3 Super কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
120B মোট (12B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
ওজন উপলভ্য
লাইসেন্স
NVIDIA Open Model

ধারাবাহিকতা

8.8

মোট আউটপুট টোকেন

44,978

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.090 / 1M

আউটপুট মূল্য

$0.450 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 12

প্রতি চেষ্টায় পাস রেট: 45.0%

অস্থির টেস্ট

3

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

21.15s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 87.80s

প্রতিক্রিয়া সময় (মোট): 380.67s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 Nemotron 3 Super

medium
খরচ
$0.000
সময়
272.6s
টোকেন
5,296 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 02:37 পুনরায় পরীক্ষা 5.7 9.1 $0.050 তুলনা করুন
2026-07-16 23:04 নতুন টেস্ট যোগ হয়েছে 5.7 8.7 $0.066 তুলনা করুন
2026-06-04 14:07 নতুন টেস্ট যোগ হয়েছে 5.8 10.0 $0.021 তুলনা করুন
2026-05-22 00:27 স্যুইট পরিবর্তিত হয়েছে 5.9 10.0 $0.001 বর্তমান রান
2026-05-08 15:31 স্যুইট পরিবর্তিত হয়েছে 6.1 10.0 $0.001 তুলনা করুন
2026-04-20 17:48 প্রথম নথিভুক্ত রান 6.7 প্রযোজ্য নয় $0.000 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-05-22 00:27 · স্যুইট পরিবর্তিত হয়েছে60/60 প্রচেষ্টা5.98.810.08/20344,9780$0.00121.15s
2026-06-04 14:07 · নতুন টেস্ট যোগ হয়েছে63/63 প্রচেষ্টা5.89.210.08/21248,60437,527$0.02132.00s
পার্থক্য+0.1-0.40.00+1-3626-37527-$0.020-10847ms

বেঞ্চমার্ক কভারেজ আলাদা: 60/60 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 63/63 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 8.3 10.0
কোডিং 3.1 9.9
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 2.9 4.4
Sadharon Buddhimotta 4.1 10.0
নির্দেশনা অনুসরণ 7.2 6.6
ধাঁধা সমাধান 3.1 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল