نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Anthropic: Claude Sonnet 5

خلاصہ

Claude Sonnet 4.6 vs Claude Sonnet 5 benchmark موازنہ: Claude Sonnet 4.6 average score میں آگے ہے: 7.3 vs 5.7. Claude Sonnet 5 کی benchmark لاگت کم ہے: $0.287 vs $0.316. Claude Sonnet 5 تیز ہے: 4.74s vs 5.04s، pass rates 55.6% vs 42.9%.

تجویز کردہ ماڈل: Claude Sonnet 4.6 - It has the strongest score in this comparison (7.3) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 4.6 Claude Sonnet 4.6 none اجرا: 2026-02-17 Claude Sonnet 5 Claude Sonnet 5 none اجرا: 2026-06-30
اسکور 7.3 5.7
درجہ #57 #117
اعتماد پذیری 10.0 10.0
تسلسل 9.7 8.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 55.6% 42.9%
غیر مستحکم ٹیسٹ 1 4
کل رنز 63 63
فی نتیجہ لاگت 2.870 4.098
کل لاگت $0.316 $0.287
ان پٹ قیمت $3.000 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $10.000 / 1M
کل ان پٹ ٹوکنز 57,886 76,797
آؤٹ پٹ ٹوکنز 9,465 13,325
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 5.04s 4.74s
ردِعمل کا وقت (زیادہ سے زیادہ) 23.84s 29.46s
ردِعمل کا وقت (کل) 70.60s 99.46s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 Claude Sonnet 4.6

none
لاگت
$0.038
وقت
27.3s
ٹوکنز
2,598 tok

#117 Claude Sonnet 5

none
لاگت
$0.061
وقت
53.7s
ٹوکنز
6,172 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 636 1,214 0
Claude Sonnet 5 5.3 10.0 25.0% 0 3.60s 834 1,813 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 26,024 3,766 0
Claude Sonnet 5 3.0 10.0 0.0% 0 29.46s 38,775 6,340 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 8,574 252 0
Claude Sonnet 5 10.0 10.0 100.0% 0 3.01s 10,503 309 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 759 413 0
Claude Sonnet 5 5.3 7.2 44.4% 1 3.28s 975 933 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 513 192 0
Claude Sonnet 5 4.7 3.1 33.3% 1 2.81s 708 272 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 690 90 0
Claude Sonnet 5 6.4 10.0 50.0% 0 2.58s 909 103 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 663 533 0
Claude Sonnet 5 6.0 7.4 55.6% 1 3.22s 894 778 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 11,301 447 0
Claude Sonnet 5 10.0 10.0 100.0% 0 6.80s 12,351 522 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 204 431 0
Claude Sonnet 5 3.0 10.0 0.0% 0 4.31s 258 391 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں