নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.7 Plus

সারাংশ

GPT-5.4 Mini vs Qwen3.7 Plus benchmark তুলনা: Qwen3.7 Plus average score-এ এগিয়ে: 8.2 vs 8.0. Qwen3.7 Plus-এর benchmark খরচ কম: $0.177 vs $0.526. GPT-5.4 Mini দ্রুত: 22.34s vs 38.95s, pass rates 73.0% vs 77.8%.

প্রস্তাবিত মডেল: Qwen3.7 Plus - It has the best score here (8.2), while costing about 3.0x less than GPT-5.4 Mini.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17 Qwen3.7 Plus Qwen3.7 Plus medium প্রকাশ: 2026-06-03
স্কোর 8.0 8.2
র‍্যাঙ্ক #30 #28
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 9.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 73.0% 77.8%
অস্থির টেস্ট 5 2
মোট রান 63 63
প্রতি ফলাফলে খরচ 4.381 1.474
মোট খরচ $0.526 $0.177
ইনপুট মূল্য $0.750 / 1M $0.320 / 1M
আউটপুট মূল্য $4.500 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 34,116 40,939
আউটপুট টোকেন 2,181 2,125
রিজনিং টোকেন 108,937 125,754
প্রতিক্রিয়া সময় (গড়) 22.34s 38.95s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 138.75s 178.04s
প্রতিক্রিয়া সময় (মোট) 469.20s 817.85s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

#28 Qwen3.7 Plus

medium
Cost
$0.018
Time
193.2s
Tokens
10,821 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
Qwen3.7 Plus 10.0 10.0 100.0% 0 8.58s 672 195 5,065
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
Qwen3.7 Plus 10.0 10.0 100.0% 0 65.24s 14,934 366 10,132
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
Qwen3.7 Plus 10.0 10.0 100.0% 0 21.75s 7,782 270 6,713
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Qwen3.7 Plus 3.6 7.2 22.2% 1 45.35s 771 57 27,073
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
Qwen3.7 Plus 10.0 10.0 100.0% 0 25.48s 516 123 3,998
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.13s 699 102 5,013
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.38s 696 280 7,312
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
Qwen3.7 Plus 10.0 10.0 100.0% 0 15.02s 8,193 292 1,831
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
Qwen3.7 Plus 3.0 10.0 0.0% 0 91.07s 204 26 15,041

দ্রুত তুলনা

তুলনার জুটি বদলান