নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.7 Max

সারাংশ

GPT-5.4 Mini vs Qwen3.7 Max benchmark তুলনা: Qwen3.7 Max average score-এ এগিয়ে: 7.7 vs 7.5. Qwen3.7 Max-এর benchmark খরচ কম: $0.054 vs $0.526. Qwen3.7 Max দ্রুত: 1.30s vs 22.34s, pass rates 73.0% vs 66.7%.

প্রস্তাবিত মডেল: Qwen3.7 Max - It has the best score here (7.7), while costing about 9.8x less than GPT-5.4 Mini.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 7.5 7.7
র‍্যাঙ্ক #46 #35
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 73.0% 66.7%
অস্থির টেস্ট 5 0
মোট রান 63 63
প্রতি ফলাফলে খরচ 4.381 0.744
মোট খরচ $0.526 $0.054
ইনপুট মূল্য $0.750 / 1M $1.250 / 1M
আউটপুট মূল্য $4.500 / 1M $3.750 / 1M
মোট ইনপুট টোকেন 34,116 37,107
আউটপুট টোকেন 2,181 1,994
রিজনিং টোকেন 108,937 0
প্রতিক্রিয়া সময় (গড়) 22.34s 1.30s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 138.75s 3.92s
প্রতিক্রিয়া সময় (মোট) 469.20s 27.21s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#46 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

#35 Qwen3.7 Max

none
Cost
$0.046
Time
195.0s
Tokens
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
Qwen3.7 Max 6.5 10.0 50.0% 0 1.08s 696 242 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
Qwen3.7 Max 3.0 10.0 0.0% 0 2.17s 9,549 171 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
Qwen3.7 Max 10.0 10.0 100.0% 0 1.35s 7,794 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Qwen3.7 Max 7.7 10.0 66.7% 0 975ms 789 15 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
Qwen3.7 Max 10.0 10.0 100.0% 0 1.04s 522 120 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
Qwen3.7 Max 10.0 10.0 100.0% 0 943ms 711 72 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
Qwen3.7 Max 10.0 10.0 100.0% 0 1.13s 714 314 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
Qwen3.7 Max 10.0 10.0 100.0% 0 3.92s 8,211 222 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
Qwen3.7 Max 3.0 10.0 0.0% 0 856ms 210 13 0

দ্রুত তুলনা

তুলনার জুটি বদলান