নেভিগেশন
Advertise here

Qwen3.5-27B (medium) vs Grok 4.7 (high)

average score প্রায় সমান: 7.5 vs 7.5. Qwen3.5-27B (medium)-এর benchmark খরচ কম: $0.982 vs $2.180. Grok 4.7 (high) দ্রুত: 113.10s vs 113.28s, pass rates 75.8% vs 75.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-21

তুলনা করা মডেল

র‍্যাঙ্ক
#114
মোট আউটপুট টোকেন
614,909
প্রতিক্রিয়া সময় (গড়)
113.28s
মোট খরচ
$0.982
র‍্যাঙ্ক
#110
মোট আউটপুট টোকেন
416,086
প্রতিক্রিয়া সময় (গড়)
113.10s
মোট খরচ
$2.180
প্রস্তাবিত মডেল Qwen3.5-27B (medium)

It has the best score here (7.5), while costing about 2.2x less than Grok 4.7 (high).

বিস্তারিত তুলনা

মেট্রিক Qwen3.5-27B Qwen3.5-27B medium প্রকাশ: 2026-02-24 Grok 4.7 Grok 4.7 high প্রকাশ: 2026-09-21
স্কোর 7.5 7.5
র‍্যাঙ্ক #114 #110
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 7.8 7.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 75.8% 75.8%
অস্থির টেস্ট 6 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.217 16.765
মোট খরচ $0.982 $2.180
ইনপুট মূল্য $0.195 / 1M $1.600 / 1M
আউটপুট মূল্য $1.560 / 1M $4.800 / 1M
মোট ইনপুট টোকেন 111,644 113,892
আউটপুট টোকেন 16,113 6,907
রিজনিং টোকেন 598,796 409,179
প্রতিক্রিয়া সময় (গড়) 113.28s 113.10s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1026.43s 573.57s
প্রতিক্রিয়া সময় (মোট) 2492.26s 2488.20s
প্যারামিটার 27B ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা উন্মুক্ত উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 Qwen3.5-27B

medium
খরচ
$0.008
সময়
62.0s
টোকেন
3,099 tok

#110 SpaceXAI: Grok 4.7

high
খরচ
$0.110
সময়
301.3s
টোকেন
23,143 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

দ্রুত তুলনা

তুলনার জুটি বদলান