নেভিগেশন
AI BENCHY
Advertise here

GPT-5.4 Nano (medium) vs Qwen3.5-27B (medium)

GPT-5.4 Nano (medium) average score-এ এগিয়ে: 7.5 vs 7.4. GPT-5.4 Nano (medium)-এর benchmark খরচ কম: $0.138 vs $0.981. GPT-5.4 Nano (medium) দ্রুত: 13.24s vs 111.94s, pass rates 65.2% vs 72.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#61
মোট আউটপুট টোকেন
97,122
প্রতিক্রিয়া সময় (গড়)
13.24s
মোট খরচ
$0.138
র‍্যাঙ্ক
#66
মোট আউটপুট টোকেন
614,429
প্রতিক্রিয়া সময় (গড়)
111.94s
মোট খরচ
$0.981
প্রস্তাবিত মডেল GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 7.1x less than Qwen3.5-27B (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 Nano GPT-5.4 Nano medium প্রকাশ: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium প্রকাশ: 2026-02-24
স্কোর 7.5 7.4
র‍্যাঙ্ক #61 #66
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 72.7%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.150 8.324
মোট খরচ $0.138 $0.981
ইনপুট মূল্য $0.200 / 1M $0.195 / 1M
আউটপুট মূল্য $1.250 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 82,819 111,635
আউটপুট টোকেন 7,100 15,999
রিজনিং টোকেন 90,022 598,430
প্রতিক্রিয়া সময় (গড়) 13.24s 111.94s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 94.06s 1026.43s
প্রতিক্রিয়া সময় (মোট) 291.33s 2462.67s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 GPT-5.4 Nano

medium
খরচ
$0.007
সময়
24.6s
টোকেন
4,943 tok

#66 Qwen3.5-27B

medium
খরচ
$0.008
সময়
62.0s
টোকেন
3,099 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

দ্রুত তুলনা

তুলনার জুটি বদলান