AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#67

Qwen3.7 Plus

Qwen প্রকাশ: 2026-06-03 পরীক্ষিত হয়েছে: 2026-07-16 21:42 qwen/qwen3.7-plus::none
~397B মোট (~17B সক্রিয়)MoEবন্ধ উৎসআনুমানিক
(medium) (none)

সারাংশ

Qwen3.7 Plus AI BENCHY-তে 7.2 স্কোর করে এবং #67 স্থানে আছে। এর reliability 10.0, pass rate 50.0%, মোট খরচ $0.106, এবং গড় response time 12.09s.

Qwen3.7 Plus কে আলাদা করে যা: এটি সমন্বিত-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর কোডিং এর দুর্বলতম ক্ষেত্র, rank #18.

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

আনুমানিক
প্যারামিটার
~397B মোট (~17B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

10.0

মোট খরচ (বর্তমান মূল্য)

$0.106 ↓ -4.9%

পরীক্ষার সময়: $0.112

মোট আউটপুট টোকেন

58,097

মোট ইনপুট টোকেন

98,824

ইনপুট মূল্য

$0.320 / 1M

আউটপুট মূল্য

$1.280 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 11

প্রতি চেষ্টায় পাস রেট: 50.0%

অস্থির টেস্ট

0

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

12.09s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 206.03s

প্রতিক্রিয়া সময় (মোট): 265.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 01:46 পুনরায় পরীক্ষা 7.3 10.0 $0.106 তুলনা করুন
2026-07-16 21:42 নতুন টেস্ট যোগ হয়েছে 7.2 10.0 $0.106 বর্তমান রান
2026-06-04 13:23 নতুন টেস্ট যোগ হয়েছে 6.4 10.0 $0.028 তুলনা করুন
2026-06-03 21:24 প্রথম রান 6.6 10.0 $0.027 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

রান তুলনা

রানবেঞ্চমার্ক কভারেজস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-07-16 21:42 · নতুন টেস্ট যোগ হয়েছে66/66 প্রচেষ্টা7.210.010.011/22058,09798,824$0.10612.09s
2026-06-03 21:24 · প্রথম রান60/60 প্রচেষ্টা6.610.010.010/2006,57239,669$0.0272.95s
পার্থক্য+0.60.00.0+10+51525+59155+$0.080+9138ms

বেঞ্চমার্ক কভারেজ আলাদা: 66/66 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি) বনাম 60/60 প্রচেষ্টা (লক্ষ্য: প্রতি টেস্টে 3টি পুনরাবৃত্তি)। মোট মান ও পুনরাবৃত্তি-সংবেদনশীল মেট্রিক সরাসরি তুলনাযোগ্য নয়।

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-04 15:40 $0.400 / 1M $1.600 / 1M
2026-06-12 18:42 $0.320 / 1M $1.280 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 6.5 10.0
কোডিং 5.5 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 3.0 10.0
Sadharon Buddhimotta 5.3 10.0
নির্দেশনা অনুসরণ 6.3 10.0
ধাঁধা সমাধান 7.7 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল