নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.6 Max Preview (medium)

Qwen3.6 Max Preview (medium) average score-এ এগিয়ে: 8.4 vs 8.0. GPT-5.2 Chat-এর benchmark খরচ কম: $0.604 vs $1.143. GPT-5.2 Chat দ্রুত: 7.65s vs 67.53s, pass rates 74.2% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#37
মোট আউটপুট টোকেন
30,424
প্রতিক্রিয়া সময় (গড়)
7.65s
মোট খরচ
$0.604
র‍্যাঙ্ক
#25
মোট আউটপুট টোকেন
169,940
প্রতিক্রিয়া সময় (গড়)
67.53s
মোট খরচ
$1.143
প্রস্তাবিত মডেল GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.4), while costing about 1.9x less than Qwen3.6 Max Preview (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 Qwen3.6 Max Preview Qwen3.6 Max Preview medium প্রকাশ: 2026-04-20
স্কোর 8.0 8.4
র‍্যাঙ্ক #37 #25
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 74.2% 80.3%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.308 8.173
মোট খরচ $0.604 $1.143
ইনপুট মূল্য $1.750 / 1M $1.040 / 1M
আউটপুট মূল্য $14.000 / 1M $6.240 / 1M
মোট ইনপুট টোকেন 101,248 79,240
আউটপুট টোকেন 30,424 5,098
রিজনিং টোকেন 0 164,842
প্রতিক্রিয়া সময় (গড়) 7.65s 67.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 238.07s
প্রতিক্রিয়া সময় (মোট) 168.39s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

#25 Qwen3.6 Max Preview

medium
খরচ
$0.024
সময়
76.5s
টোকেন
3,861 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

দ্রুত তুলনা

তুলনার জুটি বদলান