نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs OpenAI: GPT-5.2

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-28

میٹرک Claude Opus 4.8 Claude Opus 4.8 none اجرا: 2026-05-28 GPT-5.2 GPT-5.2 medium اجرا: 2025-12-11
اسکور 7.3 7.3
درجہ #63 #61
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.3
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.0% 70.0%
غیر مستحکم ٹیسٹ 2 4
کل رنز 60 60
فی نتیجہ لاگت 4.324 4.094
کل لاگت $0.519 $0.492
ان پٹ قیمت $5.000 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $14.000 / 1M
آؤٹ پٹ ٹوکنز 8,098 2,880
ریزننگ ٹوکنز 0 28,289
ردِعمل کا وقت (اوسط) 3.51s 16.50s
ردِعمل کا وقت (زیادہ سے زیادہ) 17.73s 77.80s
ردِعمل کا وقت (کل) 70.19s 214.45s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
GPT-5.2 10.0 10.0 100.0% 0 23.15s 490 8,269
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
GPT-5.2 7.5 7.3 77.8% 1 5.80s 735 924
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
GPT-5.2 3.0 10.0 0.0% 0 28.18s 26 3,223

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں