نیویگیشن
AI BENCHY
Advertise here

GPT-5.2 Chat vs GLM 5.2 (high)

GLM 5.2 (high) average score میں آگے ہے: 8.0 vs 7.9. GPT-5.2 Chat کی benchmark لاگت کم ہے: $0.594 vs $1.463. GPT-5.2 Chat تیز ہے: 7.73s vs 69.86s، pass rates 69.7% vs 69.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-29

درجہ
#60
کل آؤٹ پٹ ٹوکنز
29,742
ردِعمل کا وقت (اوسط)
7.73s
کل لاگت
$0.594
درجہ
#56
کل آؤٹ پٹ ٹوکنز
364,655
ردِعمل کا وقت (اوسط)
69.86s
کل لاگت
$1.463
تجویز کردہ ماڈل GPT-5.2 Chat

Its score stays close to the best score here (7.9 vs 8.0), while costing about 2.5x less than GLM 5.2 (high).

تفصیلی موازنہ

میٹرک GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11 GLM 5.2 GLM 5.2 high اجرا: 2026-06-17
اسکور 7.9 8.0
درجہ #60 #56
اعتماد پذیری 10.0 10.0
تسلسل 8.6 8.6
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 69.7% 69.7%
غیر مستحکم ٹیسٹ 4 3
کل رنز 66 66
فی نتیجہ لاگت 4.564 6.849
کل لاگت $0.594 $1.463
ان پٹ قیمت $1.750 / 1M $1.190 / 1M
آؤٹ پٹ قیمت $14.000 / 1M $3.740 / 1M
کل ان پٹ ٹوکنز 101,104 83,822
آؤٹ پٹ ٹوکنز 29,742 72,040
ریزننگ ٹوکنز 0 292,615
ردِعمل کا وقت (اوسط) 7.73s 69.86s
ردِعمل کا وقت (زیادہ سے زیادہ) 38.52s 599.43s
ردِعمل کا وقت (کل) 162.40s 1536.98s
پیرامیٹرز ~400B کل (~17B فعال) 744B کل (40B فعال)
دستیابی بند ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 GPT-5.2 Chat

none
لاگت
$0.010
وقت
15.3s
ٹوکنز
797 tok

#56 GLM 5.2

high
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں