নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Qwen3.7 Plus (medium)

GPT-5.2 Chat average score-এ এগিয়ে: 8.0 vs 7.9. Qwen3.7 Plus (medium)-এর benchmark খরচ কম: $0.267 vs $0.604. GPT-5.2 Chat দ্রুত: 7.65s vs 51.51s, pass rates 74.2% vs 75.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#37
মোট আউটপুট টোকেন
30,424
প্রতিক্রিয়া সময় (গড়)
7.65s
মোট খরচ
$0.604
র‍্যাঙ্ক
#43
মোট আউটপুট টোকেন
179,429
প্রতিক্রিয়া সময় (গড়)
51.51s
মোট খরচ
$0.267
প্রস্তাবিত মডেল GPT-5.2 Chat

It has the best score here (8.0), while responding about 6.7x faster than Qwen3.7 Plus (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 Qwen3.7 Plus Qwen3.7 Plus medium প্রকাশ: 2026-06-03
স্কোর 8.0 7.9
র‍্যাঙ্ক #37 #43
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 74.2% 75.8%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.308 2.072
মোট খরচ $0.604 $0.267
ইনপুট মূল্য $1.750 / 1M $0.320 / 1M
আউটপুট মূল্য $14.000 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 101,248 115,233
আউটপুট টোকেন 30,424 6,162
রিজনিং টোকেন 0 173,267
প্রতিক্রিয়া সময় (গড়) 7.65s 51.51s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 315.30s
প্রতিক্রিয়া সময় (মোট) 168.39s 1133.15s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

#43 Qwen3.7 Plus

medium
খরচ
$0.018
সময়
193.2s
টোকেন
10,821 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

দ্রুত তুলনা

তুলনার জুটি বদলান