নেভিগেশন
AI BENCHY
Advertise here

GPT-5.3 Chat vs Qwen3.5 Plus 2026-02-15 (medium)

average score প্রায় সমান: 7.5 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium)-এর benchmark খরচ কম: $0.437 vs $0.571. GPT-5.3 Chat দ্রুত: 6.88s vs 89.19s, pass rates 68.2% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#67
মোট আউটপুট টোকেন
30,854
প্রতিক্রিয়া সময় (গড়)
6.88s
মোট খরচ
$0.571
র‍্যাঙ্ক
#70
মোট আউটপুট টোকেন
260,704
প্রতিক্রিয়া সময় (গড়)
89.19s
মোট খরচ
$0.437
প্রস্তাবিত মডেল GPT-5.3 Chat

It has the best score here (7.5), while responding about 13.0x faster than Qwen3.5 Plus 2026-02-15 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium প্রকাশ: 2026-02-15
স্কোর 7.5 7.5
র‍্যাঙ্ক #67 #70
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 71.2%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.387 3.348
মোট খরচ $0.571 $0.437
ইনপুট মূল্য $1.750 / 1M $0.260 / 1M
আউটপুট মূল্য $14.000 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 78,990 113,560
আউটপুট টোকেন 30,854 9,823
রিজনিং টোকেন 0 250,881
প্রতিক্রিয়া সময় (গড়) 6.88s 89.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.33s 304.85s
প্রতিক্রিয়া সময় (মোট) 151.31s 1337.92s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

#70 Qwen3.5 Plus 2026-02-15

medium
খরচ
$0.011
সময়
125.5s
টোকেন
7,040 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

দ্রুত তুলনা

তুলনার জুটি বদলান