নেভিগেশন
AI BENCHY
Advertise here

GPT-5.5 vs Qwen3.7 Flash (medium)

Qwen3.7 Flash (medium) average score-এ এগিয়ে: 7.0 vs 6.9. Qwen3.7 Flash (medium)-এর benchmark খরচ কম: $0.064 vs $0.544. GPT-5.5 দ্রুত: 2.36s vs 45.90s, pass rates 56.1% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#98
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.36s
মোট খরচ
$0.544
র‍্যাঙ্ক
#91
মোট আউটপুট টোকেন
462,623
প্রতিক্রিয়া সময় (গড়)
45.90s
মোট খরচ
$0.064
প্রস্তাবিত মডেল Qwen3.7 Flash (medium)

It has the best score here (7.0), while costing about 8.6x less than GPT-5.5.

বিস্তারিত তুলনা

মেট্রিক GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24 Qwen3.7 Flash Qwen3.7 Flash medium প্রকাশ: 2026-07-28
স্কোর 6.9 7.0
র‍্যাঙ্ক #98 #91
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 7.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 56.1% 65.2%
অস্থির টেস্ট 3 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.945 0.636
মোট খরচ $0.544 $0.064
ইনপুট মূল্য $5.000 / 1M $0.030 / 1M
আউটপুট মূল্য $30.000 / 1M $0.130 / 1M
মোট ইনপুট টোকেন 79,285 114,468
আউটপুট টোকেন 4,915 12,786
রিজনিং টোকেন 0 449,837
প্রতিক্রিয়া সময় (গড়) 2.36s 45.90s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 12.24s 593.64s
প্রতিক্রিয়া সময় (মোট) 51.88s 1009.84s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

#91 Qwen3.7 Flash

medium
অবৈধ SVG
খরচ
$0.000
সময়
600.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

দ্রুত তুলনা

তুলনার জুটি বদলান