نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.4 Nano

خلاصہ

Claude Opus 4.6 vs GPT-5.4 Nano benchmark موازنہ: Claude Opus 4.6 average score میں آگے ہے: 7.7 vs 7.5. GPT-5.4 Nano کی benchmark لاگت کم ہے: $0.107 vs $2.053. GPT-5.4 Nano تیز ہے: 11.95s vs 25.89s، pass rates 61.9% vs 63.5%.

تجویز کردہ ماڈل: GPT-5.4 Nano - Its score stays close to the best score here (7.5 vs 7.7), while costing about 19.3x less than Claude Opus 4.6.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Claude Opus 4.6 Claude Opus 4.6 medium اجرا: 2026-02-05 GPT-5.4 Nano GPT-5.4 Nano medium اجرا: 2026-03-17
اسکور 7.7 7.5
درجہ #41 #48
اعتماد پذیری 10.0 10.0
تسلسل 8.8 8.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 61.9% 63.5%
غیر مستحکم ٹیسٹ 3 4
کل رنز 63 63
فی نتیجہ لاگت 17.103 0.969
کل لاگت $2.053 $0.107
ان پٹ قیمت $5.000 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $1.250 / 1M
کل ان پٹ ٹوکنز 53,227 35,434
آؤٹ پٹ ٹوکنز 47,446 3,014
ریزننگ ٹوکنز 24,000 76,520
ردِعمل کا وقت (اوسط) 25.89s 11.95s
ردِعمل کا وقت (زیادہ سے زیادہ) 83.40s 94.06s
ردِعمل کا وقت (کل) 362.49s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 Claude Opus 4.6

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں