نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs OpenAI: GPT-5.4

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-03

میٹرک Claude Opus 4.8 Claude Opus 4.8 none اجرا: 2026-05-28 GPT-5.4 GPT-5.4 medium اجرا: 2026-03-05
اسکور 7.3 7.9
درجہ #62 #27
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.0% 75.0%
غیر مستحکم ٹیسٹ 2 4
کل رنز 60 60
فی نتیجہ لاگت 4.324 8.765
کل لاگت $0.519 $1.140
ان پٹ قیمت $5.000 / 1M $2.500 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $15.000 / 1M
کل ان پٹ ٹوکنز 63,282 31,489
آؤٹ پٹ ٹوکنز 8,098 2,221
ریزننگ ٹوکنز 0 68,486
ردِعمل کا وقت (اوسط) 3.51s 22.31s
ردِعمل کا وقت (زیادہ سے زیادہ) 17.73s 100.41s
ردِعمل کا وقت (کل) 70.19s 446.17s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 834 1,472 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 6,768 1,323 0
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 29,658 3,259 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 10,503 308 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 975 61 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 708 230 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 909 95 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 894 783 0
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 11,775 355 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 258 212 0
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں