موازنہ کریں چارٹس

زبان:

❤️ Made by XCS

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.2

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک	Anthropic: Claude Sonnet 4.6 medium اجرا: ریلیز کی تاریخ نامعلوم	OpenAI: GPT-5.2 medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ	#8	#12
اسکور	7.43	6.93
تسلسل	9.40	8.22
فی نتیجہ لاگت	8.105	2.780
کل لاگت	$0.811	$0.251
درست ٹیسٹس
غلط ٹیسٹس	4	5
فی کوشش کامیابی کی شرح	73.8%	76.2%
غیر مستحکم ٹیسٹ	1	3
آؤٹ پٹ ٹوکنز	29,098	1,869
ریزننگ ٹوکنز	20,435	14,190

زمرہ وار تفصیل

اینٹی اے آئی چالیں	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	7.00	10.00	66.7%	0		1,031	1,093
OpenAI: GPT-5.2	7.00	7.28	77.8%	1		549	2,002

ڈیٹا پارسنگ اور استخراج	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		727	907
OpenAI: GPT-5.2	10.00	10.00	100.0%	0		234	499

ڈومین مخصوص	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	1.00	7.21	11.1%	1		25,790	16,919
OpenAI: GPT-5.2	4.00	7.21	55.6%	1		42	9,690

ہدایات کی پیروی	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		316	523
OpenAI: GPT-5.2	9.50	10.00	100.0%	0		95	587

Puzzle Solving	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		579	642
OpenAI: GPT-5.2	8.00	10.00	66.7%	0		710	943

ٹول کالنگ	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6	10.00	10.00	100.0%	0		655	351
OpenAI: GPT-5.2	1.00	1.62	66.7%	1		239	469

موازنہ کی جوڑی تبدیل کریں

Anthropic: Claude Sonnet 4.6 کا موازنہ اس کے ساتھ کریں...

OpenAI: GPT-5.2 کا موازنہ اس کے ساتھ کریں...