موازنہ کریں چارٹس

زبان:

❤️ Made by XCS

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.5-35B-A3B

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک	OpenAI: GPT-5.3-Codex medium اجرا: ریلیز کی تاریخ نامعلوم	Qwen: Qwen3.5-35B-A3B medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ	#7	#22
اسکور	7.93	5.93
تسلسل	8.84	6.62
فی نتیجہ لاگت	4.641	5.169
کل لاگت	$0.465	$0.362
درست ٹیسٹس
غلط ٹیسٹس	4	7
فی کوشش کامیابی کی شرح	78.6%	73.8%
غیر مستحکم ٹیسٹ	2	6
آؤٹ پٹ ٹوکنز	1,201	1,317
ریزننگ ٹوکنز	30,056	177,502

زمرہ وار تفصیل

اینٹی اے آئی چالیں	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		216	1,421
Qwen: Qwen3.5-35B-A3B	10.00	10.00	100.0%	0		429	36,235

ڈیٹا پارسنگ اور استخراج	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		234	735
Qwen: Qwen3.5-35B-A3B	5.50	5.87	83.3%	1		235	19,493

ڈومین مخصوص	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	4.00	7.21	55.6%	1		64	25,308
Qwen: Qwen3.5-35B-A3B	1.00	4.41	44.5%	2		41	46,368

ہدایات کی پیروی	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	9.00	10.00	50.0%	0		93	693
Qwen: Qwen3.5-35B-A3B	8.00	6.80	66.7%	1		97	17,361

Puzzle Solving	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	7.00	7.38	77.8%	1		340	1,407
Qwen: Qwen3.5-35B-A3B	4.33	4.70	66.7%	2		206	56,680

ٹول کالنگ	اسکور	تسلسل	فی کوشش کامیابی کی شرح	غیر مستحکم ٹیسٹ	درست ٹیسٹس	آؤٹ پٹ ٹوکنز	ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex	10.00	10.00	100.0%	0		254	492
Qwen: Qwen3.5-35B-A3B	10.00	10.00	100.0%	0		309	1,365

موازنہ کی جوڑی تبدیل کریں

OpenAI: GPT-5.3-Codex کا موازنہ اس کے ساتھ کریں...

Qwen: Qwen3.5-35B-A3B کا موازنہ اس کے ساتھ کریں...