نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Anthropic: Claude Sonnet 5

خلاصہ

Claude Sonnet 4.6 vs Claude Sonnet 5 benchmark موازنہ: average score تقریباً برابر ہے: 7.8 vs 7.9. Claude Sonnet 5 کی benchmark لاگت کم ہے: $0.550 vs $1.418. Claude Sonnet 5 تیز ہے: 9.94s vs 17.06s، pass rates 65.1% vs 79.4%.

تجویز کردہ ماڈل: Claude Sonnet 5 - It has the best score here (7.9), while costing about 2.6x less than Claude Sonnet 4.6.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-30

میٹرک Claude Sonnet 4.6 Claude Sonnet 4.6 medium اجرا: 2026-02-17 Claude Sonnet 5 Claude Sonnet 5 medium اجرا: 2026-06-30
اسکور 7.8 7.9
درجہ #32 #30
اعتماد پذیری 10.0 10.0
تسلسل 9.1 9.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.1% 79.4%
غیر مستحکم ٹیسٹ 2 3
کل رنز 63 63
فی نتیجہ لاگت 10.904 3.662
کل لاگت $1.418 $0.550
ان پٹ قیمت $3.000 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $10.000 / 1M
کل ان پٹ ٹوکنز 49,112 67,416
آؤٹ پٹ ٹوکنز 54,703 34,012
ریزننگ ٹوکنز 29,970 7,673
ردِعمل کا وقت (اوسط) 17.06s 9.94s
ردِعمل کا وقت (زیادہ سے زیادہ) 46.35s 56.94s
ردِعمل کا وقت (کل) 221.83s 208.71s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 Claude Sonnet 4.6

medium
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

#30 Claude Sonnet 5

medium
لاگت
$0.007
وقت
6.4s
ٹوکنز
832 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 789 1,046 1,093
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 18,351 5,871 3,962
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 8,676 649 742
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 471 25,790 16,919
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 564 256 433
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 792 318 552
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 5.31s 816 592 646
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 11,454 655 351
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 204 3,437 1,586
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں