نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs OpenAI: GPT-5.5

خلاصہ

Claude Sonnet 5 vs GPT-5.5 benchmark موازنہ: GPT-5.5 average score میں آگے ہے: 9.3 vs 5.7. Claude Sonnet 5 کی benchmark لاگت کم ہے: $0.287 vs $0.907. Claude Sonnet 5 تیز ہے: 4.74s vs 9.76s، pass rates 42.9% vs 85.7%.

تجویز کردہ ماڈل: GPT-5.5 - It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 none اجرا: 2026-06-30 GPT-5.5 GPT-5.5 low اجرا: 2026-04-24
اسکور 5.7 9.3
درجہ #117 #4
اعتماد پذیری 10.0 10.0
تسلسل 8.6 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.9% 85.7%
غیر مستحکم ٹیسٹ 4 0
کل رنز 63 63
فی نتیجہ لاگت 4.098 5.035
کل لاگت $0.287 $0.907
ان پٹ قیمت $2.000 / 1M $5.000 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $30.000 / 1M
کل ان پٹ ٹوکنز 76,797 34,209
آؤٹ پٹ ٹوکنز 13,325 2,046
ریزننگ ٹوکنز 0 22,460
ردِعمل کا وقت (اوسط) 4.74s 9.76s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.46s 56.19s
ردِعمل کا وقت (کل) 99.46s 204.92s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Claude Sonnet 5

none
لاگت
$0.061
وقت
53.7s
ٹوکنز
6,172 tok

#4 GPT-5.5

low
لاگت
$0.068
وقت
37.0s
ٹوکنز
2,339 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
GPT-5.5 10.0 10.0 100.0% 0 4.41s 606 238 1,020
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
GPT-5.5 10.0 10.0 100.0% 0 9.56s 11,019 303 717
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
GPT-5.5 10.0 10.0 100.0% 0 3.28s 7,140 228 157
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
GPT-5.5 5.3 10.0 33.3% 0 28.05s 723 69 11,609
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
GPT-5.5 10.0 10.0 100.0% 0 5.17s 477 133 245
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
GPT-5.5 9.9 10.0 100.0% 0 3.74s 660 93 415
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
GPT-5.5 10.0 10.0 100.0% 0 4.74s 642 279 954
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
GPT-5.5 10.0 10.0 100.0% 0 4.96s 5,445 250 101
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0
GPT-5.5 3.0 10.0 0.0% 0 10.06s 195 30 840

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں