নেভিগেশন
AI BENCHY
Advertise here

GPT-5.5 vs Qwen3.5-35B-A3B (medium)

GPT-5.5 average score-এ এগিয়ে: 6.9 vs 6.2. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $0.837. GPT-5.5 দ্রুত: 2.36s vs 112.47s, pass rates 56.1% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#98
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.36s
মোট খরচ
$0.544
র‍্যাঙ্ক
#133
মোট আউটপুট টোকেন
826,670
প্রতিক্রিয়া সময় (গড়)
112.47s
মোট খরচ
$0.837
প্রস্তাবিত মডেল GPT-5.5

It has the best score here (6.9), while costing about 1.5x less than Qwen3.5-35B-A3B (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium প্রকাশ: 2026-02-24
স্কোর 6.9 6.2
র‍্যাঙ্ক #98 #133
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 7.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 56.1% 66.7%
অস্থির টেস্ট 3 6
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.945 9.130
মোট খরচ $0.544 $0.837
ইনপুট মূল্য $5.000 / 1M $0.140 / 1M
আউটপুট মূল্য $30.000 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 79,285 130,388
আউটপুট টোকেন 4,915 40,630
রিজনিং টোকেন 0 786,040
প্রতিক্রিয়া সময় (গড়) 2.36s 112.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 12.24s 950.25s
প্রতিক্রিয়া সময় (মোট) 51.88s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

#133 Qwen3.5-35B-A3B

medium
খরচ
$0.009
সময়
71.4s
টোকেন
8,631 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

দ্রুত তুলনা

তুলনার জুটি বদলান