নেভিগেশন
Advertise here

GPT-5.4 (medium) vs Qwen3.8 Max (low)

average score প্রায় সমান: 8.5 vs 8.6. Qwen3.8 Max (low)-এর benchmark খরচ কম: $0.702 vs $1.560. Qwen3.8 Max (low) দ্রুত: 21.83s vs 22.85s, pass rates 77.3% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-18

তুলনা করা মডেল

র‍্যাঙ্ক
#51
মোট আউটপুট টোকেন
90,466
প্রতিক্রিয়া সময় (গড়)
22.85s
মোট খরচ
$1.560
র‍্যাঙ্ক
#50
মোট আউটপুট টোকেন
83,821
প্রতিক্রিয়া সময় (গড়)
21.83s
মোট খরচ
$0.702
প্রস্তাবিত মডেল Qwen3.8 Max (low)

It has the best score here (8.6), while costing about 2.2x less than GPT-5.4 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05 Qwen3.8 Max Qwen3.8 Max low প্রকাশ: 2026-08-04
স্কোর 8.5 8.6
র‍্যাঙ্ক #51 #50
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 9.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 77.3% 80.3%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 10.399 4.384
মোট খরচ $1.560 $0.702
ইনপুট মূল্য $2.500 / 1M $2.000 / 1M
আউটপুট মূল্য $15.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 81,136 99,181
আউটপুট টোকেন 6,155 6,132
রিজনিং টোকেন 84,311 77,689
প্রতিক্রিয়া সময় (গড়) 22.85s 21.83s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.41s 155.75s
প্রতিক্রিয়া সময় (মোট) 502.78s 480.37s
প্যারামিটার ~1.5T মোট (~100B সক্রিয়) 2.4T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

#50 Qwen3.8 Max

low
খরচ
$0.026
সময়
68.5s
টোকেন
4,280 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

দ্রুত তুলনা

তুলনার জুটি বদলান