নেভিগেশন
AI BENCHY
Advertise here

Granite 4.1 8B vs Qwen3.5-9B (medium)

Granite 4.1 8B average score-এ এগিয়ে: 4.0 vs 3.8. Granite 4.1 8B-এর benchmark খরচ কম: $0.007 vs $0.036. Granite 4.1 8B দ্রুত: 1.45s vs 82.24s, pass rates 9.1% vs 25.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#224
মোট আউটপুট টোকেন
5,996
প্রতিক্রিয়া সময় (গড়)
1.45s
মোট খরচ
$0.007
র‍্যাঙ্ক
#227
মোট আউটপুট টোকেন
238,561
প্রতিক্রিয়া সময় (গড়)
82.24s
মোট খরচ
$0.036
প্রস্তাবিত মডেল Granite 4.1 8B

It has the best score here (4.0), while costing about 5.7x less than Qwen3.5-9B (medium).

বিস্তারিত তুলনা

মেট্রিক Granite 4.1 8B Granite 4.1 8B none প্রকাশ: 2026-05-01 Qwen3.5-9B Qwen3.5-9B medium প্রকাশ: 2026-03-02
স্কোর 4.0 3.8
র‍্যাঙ্ক #224 #227
নির্ভরযোগ্যতা 10.0 5.0
ধারাবাহিকতা 10.0 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 9.1% 25.8%
অস্থির টেস্ট 0 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.315 1.187
মোট খরচ $0.007 $0.036
ইনপুট মূল্য $0.050 / 1M $0.100 / 1M
আউটপুট মূল্য $0.100 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 113,827 17,070
আউটপুট টোকেন 5,996 29,045
রিজনিং টোকেন 0 209,516
প্রতিক্রিয়া সময় (গড়) 1.45s 82.24s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 16.67s 226.38s
প্রতিক্রিয়া সময় (মোট) 31.96s 1315.88s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 IBM: Granite 4.1 8B

none
খরচ
$0.001
সময়
3.2s
টোকেন
491 tok

#227 Qwen3.5-9B

medium
খরচ
$0.001
সময়
35.9s
টোকেন
3,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

দ্রুত তুলনা

তুলনার জুটি বদলান