موازنہ کریں چارٹس

زبان:

❤️ Made by XCS

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.3-Codex

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک	Anthropic: Claude Sonnet 4.6 none اجرا: ریلیز کی تاریخ نامعلوم	OpenAI: GPT-5.3-Codex medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ	#14	#7
اسکور	6.36	7.93
تسلسل	9.50	8.84
فی نتیجہ لاگت	1.325	4.641
کل لاگت	$0.106	$0.465
درست ٹیسٹس
غلط ٹیسٹس	6	4
فی کوشش کامیابی کی شرح	59.5%	78.6%
غیر مستحکم ٹیسٹ	1	2
آؤٹ پٹ ٹوکنز	2,637	1,201
ریزننگ ٹوکنز	0	30,056

زمرہ وار تفصیل

اینٹی اے آئی چالیں	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	4.00	10.00	33.3%	0		1,199	0
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		216	1,421

ڈیٹا پارسنگ اور استخراج	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		252	0
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		234	735

ڈومین مخصوص	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	7.00	10.00	66.7%	0		54	0
OpenAI: GPT-5.3-Codex	4.00	7.21	55.6%	1		64	25,308

ہدایات کی پیروی	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	5.50	10.00	50.0%	0		90	0
OpenAI: GPT-5.3-Codex	9.00	10.00	50.0%	0		93	693

Puzzle Solving	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	5.00	7.68	44.4%	1		595	0
OpenAI: GPT-5.3-Codex	7.00	7.38	77.8%	1		340	1,407

ٹول کالنگ	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		447	0
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		254	492

موازنہ کی جوڑی تبدیل کریں

Anthropic: Claude Sonnet 4.6 کا موازنہ اس کے ساتھ کریں...

OpenAI: GPT-5.3-Codex کا موازنہ اس کے ساتھ کریں...