نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.4

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-16

میٹرک Claude Opus 4.7 Claude Opus 4.7 none اجرا: 2026-04-16 GPT-5.4 GPT-5.4 medium اجرا: 2026-03-05
اسکور 9.2 8.2
درجہ #4 #16
تسلسل 10.0 8.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 88.9% 79.6%
غیر مستحکم ٹیسٹ 0 3
کل رنز 54 54
فی نتیجہ لاگت 3.155 6.399
کل لاگت $0.505 $0.832
?? ?? ???? $5.000 / 1M $2.500 / 1M
??? ?? ???? $25.000 / 1M $15.000 / 1M
آؤٹ پٹ ٹوکنز 6,326 2,169
ریزننگ ٹوکنز 0 48,732
ردِعمل کا وقت (اوسط) 3.13s 18.63s
ردِعمل کا وقت (زیادہ سے زیادہ) 18.27s 100.41s
ردِعمل کا وقت (کل) 56.33s 335.26s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں