নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Qwen: Qwen3.5-27B

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-03

মেট্রিক GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05 Qwen3.5-27B Qwen3.5-27B medium প্রকাশ: 2026-02-24
স্কোর 7.9 7.9
র‍্যাঙ্ক #27 #24
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 75.0% 73.3%
অস্থির টেস্ট 4 3
মোট রান 60 60
প্রতি ফলাফলে খরচ 8.765 4.532
মোট খরচ $1.140 $0.488
ইনপুট মূল্য $2.500 / 1M $0.195 / 1M
আউটপুট মূল্য $15.000 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 31,489 39,329
আউটপুট টোকেন 2,221 2,569
রিজনিং টোকেন 68,486 304,894
প্রতিক্রিয়া সময় (গড়) 22.31s 60.09s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.41s 177.36s
প্রতিক্রিয়া সময় (মোট) 446.17s 1201.89s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
Qwen3.5-27B 7.0 9.8 50.0% 0 123.86s 5,060 416 64,993
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683

দ্রুত তুলনা

তুলনার জুটি বদলান