নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Flash

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 6.1. Qwen3.6 Flash-এর benchmark খরচ কম: $0.062 vs $1.253. Qwen3.6 Flash দ্রুত: 3.74s vs 10.13s, pass rates 86.4% vs 34.9%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24 Qwen3.6 Flash Qwen3.6 Flash none প্রকাশ: 2026-04-20
স্কোর 9.3 6.1
র‍্যাঙ্ক #9 #135
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 86.4% 34.9%
অস্থির টেস্ট 0 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.594 0.935
মোট খরচ $1.253 $0.062
ইনপুট মূল্য $5.000 / 1M $0.188 / 1M
আউটপুট মূল্য $30.000 / 1M $1.125 / 1M
মোট ইনপুট টোকেন 80,058 139,788
আউটপুট টোকেন 5,378 30,947
রিজনিং টোকেন 23,040 0
প্রতিক্রিয়া সময় (গড়) 10.13s 3.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 56.19s 48.79s
প্রতিক্রিয়া সময় (মোট) 222.82s 82.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

#135 Qwen3.6 Flash

none
খরচ
$0.005
সময়
20.1s
টোকেন
4,211 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0

দ্রুত তুলনা

তুলনার জুটি বদলান