نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.5

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-26

میٹرک Claude Opus 4.7 Claude Opus 4.7 none اجرا: 2026-04-16 GPT-5.5 GPT-5.5 low اجرا: 2026-04-24
اسکور 9.2 9.0
درجہ #4 #5
اعتماد پذیری دستیاب نہیں 10.0
تسلسل 10.0 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 88.9% 87.0%
غیر مستحکم ٹیسٹ 0 1
کل رنز 54 54
فی نتیجہ لاگت 3.155 4.534
کل لاگت $0.505 $0.681
?? ?? ???? $5.000 / 1M $5.000 / 1M
??? ?? ???? $25.000 / 1M $30.000 / 1M
آؤٹ پٹ ٹوکنز 6,326 1,959
ریزننگ ٹوکنز 0 16,134
ردِعمل کا وقت (اوسط) 3.13s 8.39s
ردِعمل کا وقت (زیادہ سے زیادہ) 18.27s 56.19s
ردِعمل کا وقت (کل) 56.33s 151.01s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
GPT-5.5 10.0 10.0 100.0% 0 4.15s 232 1,056
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
GPT-5.5 10.0 10.0 100.0% 0 3.45s 143 132
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
GPT-5.5 9.0 7.9 88.9% 1 4.48s 272 948
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں