নেভিগেশন
AI BENCHY
Advertise here

GPT-5.4 Mini (medium) vs Qwen3.5 Plus 2026-02-15 (medium)

average score প্রায় সমান: 7.5 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium)-এর benchmark খরচ কম: $0.437 vs $0.756. GPT-5.4 Mini (medium) দ্রুত: 25.94s vs 89.19s, pass rates 71.2% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#69
মোট আউটপুট টোকেন
151,755
প্রতিক্রিয়া সময় (গড়)
25.94s
মোট খরচ
$0.756
র‍্যাঙ্ক
#70
মোট আউটপুট টোকেন
260,704
প্রতিক্রিয়া সময় (গড়)
89.19s
মোট খরচ
$0.437
প্রস্তাবিত মডেল GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 3.4x faster than Qwen3.5 Plus 2026-02-15 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium প্রকাশ: 2026-02-15
স্কোর 7.5 7.5
র‍্যাঙ্ক #69 #70
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.7 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 71.2%
অস্থির টেস্ট 6 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.299 3.348
মোট খরচ $0.756 $0.437
ইনপুট মূল্য $0.750 / 1M $0.260 / 1M
আউটপুট মূল্য $4.500 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 97,155 113,560
আউটপুট টোকেন 6,211 9,823
রিজনিং টোকেন 145,544 250,881
প্রতিক্রিয়া সময় (গড়) 25.94s 89.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 138.75s 304.85s
প্রতিক্রিয়া সময় (মোট) 570.66s 1337.92s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.4 Mini

medium
খরচ
$0.056
সময়
95.5s
টোকেন
12,464 tok

#70 Qwen3.5 Plus 2026-02-15

medium
খরচ
$0.011
সময়
125.5s
টোকেন
7,040 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

দ্রুত তুলনা

তুলনার জুটি বদলান