নেভিগেশন
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

GPT-5.4 (medium) average score-এ এগিয়ে: 8.8 vs 8.7. Qwen3.8 27B (high)-এর benchmark খরচ কম: ~$0.298 vs $2.006. GPT-5.4 (medium) দ্রুত: 24.81s vs 166.34s, pass rates 78.3% vs 78.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#50
মোট আউটপুট টোকেন
96,502
প্রতিক্রিয়া সময় (গড়)
24.81s
মোট খরচ
$2.006
র‍্যাঙ্ক
#55
মোট আউটপুট টোকেন
677,080
প্রতিক্রিয়া সময় (গড়)
166.34s
মোট খরচ
~$0.298
প্রস্তাবিত মডেল Qwen3.8 27B (high)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 6.7x less than GPT-5.4 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high প্রকাশ: 2026-08-14 বিনামূল্যে উপলভ্য
স্কোর 8.8 8.7
র‍্যাঙ্ক #50 #55
নির্ভরযোগ্যতা 10.0 9.7
ধারাবাহিকতা 8.7 9.2
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 78.3% 78.3%
অস্থির টেস্ট 4 2
মোট রান 69 69
প্রতি ফলাফলে খরচ 12.535 ~1.751
মোট খরচ $2.006 ~$0.298
ইনপুট মূল্য $2.500 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $15.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 223,210 348,967
আউটপুট টোকেন 7,312 1,005
রিজনিং টোকেন 89,190 676,075
প্রতিক্রিয়া সময় (গড়) 24.81s 166.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.41s 640.85s
প্রতিক্রিয়া সময় (মোট) 570.60s 3825.81s
প্যারামিটার ~1.5T মোট (~100B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

#55 Qwen3.8 27B

high
খরচ
~$0.008
সময়
270.1s
টোকেন
18,963 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

দ্রুত তুলনা

তুলনার জুটি বদলান

GPT-5.2mediumvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যQwen3.8 27Bhighবিনামূল্যে উপলভ্যvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যGPT-6 SollowvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যMuse Spark 1.2lowvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যMuse Spark 1.1lowvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যClaude Sonnet 5.5xhighvsQwen3.8 27Bhighবিনামূল্যে উপলভ্য