نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs OpenAI: GPT-5.3 Chat

خلاصہ

Claude Sonnet 5 vs GPT-5.3 Chat benchmark موازنہ: Claude Sonnet 5 average score میں آگے ہے: 7.9 vs 7.5. GPT-5.3 Chat کی benchmark لاگت کم ہے: $0.433 vs $0.550. GPT-5.3 Chat تیز ہے: 6.34s vs 9.94s، pass rates 79.4% vs 66.7%.

تجویز کردہ ماڈل: GPT-5.3 Chat - Its score stays close to the best score here (7.5 vs 7.9), while responding about 1.6x faster than Claude Sonnet 5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 5 Claude Sonnet 5 medium اجرا: 2026-06-30 GPT-5.3 Chat GPT-5.3 Chat none اجرا: 2026-03-03
اسکور 7.9 7.5
درجہ #30 #47
اعتماد پذیری 10.0 10.0
تسلسل 9.0 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 79.4% 66.7%
غیر مستحکم ٹیسٹ 3 5
کل رنز 63 63
فی نتیجہ لاگت 3.662 3.605
کل لاگت $0.550 $0.433
ان پٹ قیمت $2.000 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $10.000 / 1M $14.000 / 1M
کل ان پٹ ٹوکنز 67,416 34,209
آؤٹ پٹ ٹوکنز 34,012 26,617
ریزننگ ٹوکنز 7,673 0
ردِعمل کا وقت (اوسط) 9.94s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 56.94s 18.33s
ردِعمل کا وقت (کل) 208.71s 133.13s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Sonnet 5

medium
لاگت
$0.007
وقت
6.4s
ٹوکنز
832 tok

#47 GPT-5.3 Chat

none
لاگت
$0.008
وقت
8.1s
ٹوکنز
634 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں