নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.7 Max

average score প্রায় সমান: 7.5 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.756. Qwen3.7 Max দ্রুত: 4.52s vs 25.94s, pass rates 71.2% vs 68.2%.

প্রস্তাবিত মডেলQwen3.7 MaxIt has the best score here (7.4), while costing about 3.8x less than GPT-5.4 Mini (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.4 Mini GPT-5.4 Mini medium প্রকাশ: 2026-03-17 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 7.5 7.4
র‍্যাঙ্ক #64 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 7.7 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 68.2%
অস্থির টেস্ট 6 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.299 1.582
মোট খরচ $0.756 $0.197
ইনপুট মূল্য $0.750 / 1M $1.475 / 1M
আউটপুট মূল্য $4.500 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 97,155 95,983
আউটপুট টোকেন 6,211 12,446
রিজনিং টোকেন 145,544 0
প্রতিক্রিয়া সময় (গড়) 25.94s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 138.75s 72.30s
প্রতিক্রিয়া সময় (মোট) 570.66s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.4 Mini

medium
খরচ
$0.056
সময়
95.5s
টোকেন
12,464 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান