نیویگیشن
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.4 Mini

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-21

میٹرک Claude Sonnet 4.6 Claude Sonnet 4.6 medium اجرا: 2026-02-17 GPT-5.4 Mini GPT-5.4 Mini medium اجرا: 2026-03-17
اسکور 7.9 7.1
درجہ #21 #36
تسلسل 9.5 7.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 72.6% 68.6%
غیر مستحکم ٹیسٹ 1 6
کل رنز 51 51
فی نتیجہ لاگت 8.531 3.610
کل لاگت $1.024 $0.289
?? ?? ???? $3.000 / 1M $0.750 / 1M
??? ?? ???? $15.000 / 1M $4.500 / 1M
آؤٹ پٹ ٹوکنز 35,174 1,708
ریزننگ ٹوکنز 24,687 58,019
ردِعمل کا وقت (اوسط) 10.09s 15.66s
ردِعمل کا وقت (زیادہ سے زیادہ) 46.35s 102.91s
ردِعمل کا وقت (کل) 90.85s 266.14s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں