নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.5-122B-A10B (medium)

GPT-5.2 Chat average score-এ এগিয়ে: 8.0 vs 7.1. GPT-5.2 Chat-এর benchmark খরচ কম: $0.604 vs $1.046. GPT-5.2 Chat দ্রুত: 7.65s vs 64.16s, pass rates 74.2% vs 71.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#37
মোট আউটপুট টোকেন
30,424
প্রতিক্রিয়া সময় (গড়)
7.65s
মোট খরচ
$0.604
র‍্যাঙ্ক
#82
মোট আউটপুট টোকেন
487,218
প্রতিক্রিয়া সময় (গড়)
64.16s
মোট খরচ
$1.046
প্রস্তাবিত মডেল GPT-5.2 Chat

It has the best score here (8.0), while costing about 1.7x less than Qwen3.5-122B-A10B (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium প্রকাশ: 2026-02-24
স্কোর 8.0 7.1
র‍্যাঙ্ক #37 #82
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 74.2% 71.2%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.308 8.509
মোট খরচ $0.604 $1.046
ইনপুট মূল্য $1.750 / 1M $0.260 / 1M
আউটপুট মূল্য $14.000 / 1M $2.080 / 1M
মোট ইনপুট টোকেন 101,248 124,771
আউটপুট টোকেন 30,424 44,077
রিজনিং টোকেন 0 443,141
প্রতিক্রিয়া সময় (গড়) 7.65s 64.16s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 519.30s
প্রতিক্রিয়া সময় (মোট) 168.39s 1411.60s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

#82 Qwen3.5-122B-A10B

medium
খরচ
$0.019
সময়
48.7s
টোকেন
6,034 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

দ্রুত তুলনা

তুলনার জুটি বদলান