نیویگیشن
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.5 Plus 2026-02-15 (medium)

GPT-5.2 Chat average score میں آگے ہے: 8.0 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) کی benchmark لاگت کم ہے: $0.437 vs $0.604. GPT-5.2 Chat تیز ہے: 7.65s vs 89.19s، pass rates 74.2% vs 71.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

درجہ
#37
کل آؤٹ پٹ ٹوکنز
30,424
ردِعمل کا وقت (اوسط)
7.65s
کل لاگت
$0.604
درجہ
#65
کل آؤٹ پٹ ٹوکنز
260,704
ردِعمل کا وقت (اوسط)
89.19s
کل لاگت
$0.437
تجویز کردہ ماڈل GPT-5.2 Chat

It has the best score here (8.0), while responding about 11.7x faster than Qwen3.5 Plus 2026-02-15 (medium).

تفصیلی موازنہ

میٹرک GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium اجرا: 2026-02-15
اسکور 8.0 7.5
درجہ #37 #65
اعتماد پذیری 10.0 10.0
تسلسل 8.6 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 74.2% 71.2%
غیر مستحکم ٹیسٹ 4 4
کل رنز 66 66
فی نتیجہ لاگت 4.308 3.348
کل لاگت $0.604 $0.437
ان پٹ قیمت $1.750 / 1M $0.260 / 1M
آؤٹ پٹ قیمت $14.000 / 1M $1.560 / 1M
کل ان پٹ ٹوکنز 101,248 113,560
آؤٹ پٹ ٹوکنز 30,424 9,823
ریزننگ ٹوکنز 0 250,881
ردِعمل کا وقت (اوسط) 7.65s 89.19s
ردِعمل کا وقت (زیادہ سے زیادہ) 38.52s 304.85s
ردِعمل کا وقت (کل) 168.39s 1337.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
لاگت
$0.010
وقت
15.3s
ٹوکنز
797 tok

#65 Qwen3.5 Plus 2026-02-15

medium
لاگت
$0.011
وقت
125.5s
ٹوکنز
7,040 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں