নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.7 Max

GPT-5.3 Chat average score-এ এগিয়ে: 7.5 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.571. Qwen3.7 Max দ্রুত: 4.52s vs 6.88s, pass rates 68.2% vs 68.2%.

প্রস্তাবিত মডেলQwen3.7 MaxIts score stays close to the best score here (7.4 vs 7.5), while costing about 2.9x less than GPT-5.3 Chat.
র‍্যাঙ্ক
#62
প্রতি চেষ্টায় পাস রেট
68.2%
মোট আউটপুট টোকেন
30,854
প্রতিক্রিয়া সময় (গড়)
6.88s
মোট খরচ
$0.571
র‍্যাঙ্ক
#67
প্রতি চেষ্টায় পাস রেট
68.2%
মোট আউটপুট টোকেন
12,446
প্রতিক্রিয়া সময় (গড়)
4.52s
মোট খরচ
$0.197

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 7.5 7.4
র‍্যাঙ্ক #62 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.2 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 68.2%
অস্থির টেস্ট 5 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.387 1.582
মোট খরচ $0.571 $0.197
ইনপুট মূল্য $1.750 / 1M $1.475 / 1M
আউটপুট মূল্য $14.000 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 78,990 95,983
আউটপুট টোকেন 30,854 12,446
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 6.88s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.33s 72.30s
প্রতিক্রিয়া সময় (মোট) 151.31s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান