AI BENCHY
Advertise here
#20

Qwen3.5-122B-A10B

Qwen প্রকাশ: 2026-02-24 পরীক্ষিত হয়েছে: 2026-04-11 01:44 qwen/qwen3.5-122b-a10b::medium
122B মোট (10B সক্রিয়)MoEউন্মুক্ত উৎস
(medium) (none)

সারাংশ

Qwen3.5-122B-A10B AI BENCHY-তে 8.1 স্কোর করে এবং #20 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 79.6%, মোট খরচ $0.528, এবং গড় response time 31.38s.

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
122B মোট (10B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
উন্মুক্ত উৎস
লাইসেন্স
Apache-2.0

ধারাবাহিকতা

8.6

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

180,303

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.260 / 1M

আউটপুট মূল্য

$2.080 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 5

প্রতি চেষ্টায় পাস রেট: 79.6%

অস্থির টেস্ট

3

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

31.38s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 119.29s

প্রতিক্রিয়া সময় (মোট): 564.84s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Qwen3.5-122B-A10B

medium
খরচ
$0.019
সময়
48.7s
টোকেন
6,034 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 01:54 পুনরায় পরীক্ষা 7.1 10.0 $1.207 তুলনা করুন
2026-07-16 22:21 নতুন টেস্ট যোগ হয়েছে 7.1 10.0 $1.046 তুলনা করুন
2026-06-04 13:31 নতুন টেস্ট যোগ হয়েছে 7.8 10.0 $0.588 তুলনা করুন
2026-05-22 00:03 স্যুইট পরিবর্তিত হয়েছে 7.7 10.0 $0.650 তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান 8.1 প্রযোজ্য নয় $0.528 বর্তমান রান

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 10.0 10.0
কোডিং 4.7 1.6
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 2.9 7.2
Sadharon Buddhimotta 3.4 2.2
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 10.0 10.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল