নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.7 Plus

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-03

মেট্রিক GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24 Qwen3.7 Plus Qwen3.7 Plus medium প্রকাশ: 2026-06-03
স্কোর 8.7 8.4
র‍্যাঙ্ক #10 #16
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.8 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 86.7% 80.0%
অস্থির টেস্ট 3 2
মোট রান 60 60
প্রতি ফলাফলে খরচ 21.884 1.324
মোট খরচ $3.502 $0.199
ইনপুট মূল্য $5.000 / 1M $0.400 / 1M
আউটপুট মূল্য $30.000 / 1M $1.600 / 1M
মোট ইনপুট টোকেন 31,593 38,104
আউটপুট টোকেন 1,964 2,107
রিজনিং টোকেন 109,481 112,479
প্রতিক্রিয়া সময় (গড়) 37.88s 36.84s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 332.10s 178.04s
প্রতিক্রিয়া সময় (মোট) 757.66s 736.86s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 4.66s 606 250 1,335
Qwen3.7 Plus 10.0 10.0 100.0% 0 8.58s 672 195 5,065
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 8.2 6.7 83.3% 1 69.68s 4,686 341 19,515
Qwen3.7 Plus 6.5 5.9 66.7% 1 122.40s 3,637 396 30,301
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 19.29s 11,019 312 2,841
Qwen3.7 Plus 10.0 10.0 100.0% 0 65.24s 14,934 366 10,132
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 4.18s 7,140 234 593
Qwen3.7 Plus 10.0 10.0 100.0% 0 21.75s 7,782 270 6,713
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 5.3 7.2 44.4% 1 164.14s 723 67 79,625
Qwen3.7 Plus 3.6 7.2 22.2% 1 45.35s 771 57 27,073
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 4.16s 477 138 223
Qwen3.7 Plus 10.0 10.0 100.0% 0 25.48s 516 123 3,998
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 3.36s 660 93 538
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.13s 699 102 5,013
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 6.76s 642 241 2,225
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.38s 696 280 7,312
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 10.57s 5,445 258 832
Qwen3.7 Plus 10.0 10.0 100.0% 0 15.02s 8,193 292 1,831
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 2.8 1.6 33.3% 1 37.86s 195 30 1,754
Qwen3.7 Plus 3.0 10.0 0.0% 0 91.07s 204 26 15,041

দ্রুত তুলনা

তুলনার জুটি বদলান