نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.5-35B-A3B

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک OpenAI: GPT-5.3-Codex medium اجرا: ریلیز کی تاریخ نامعلوم Qwen: Qwen3.5-35B-A3B medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ #7 #22
اسکور 7.93 5.93
تسلسل 8.84 6.62
فی نتیجہ لاگت 4.641 5.169
کل لاگت $0.465 $0.362
درست ٹیسٹس
غلط ٹیسٹس 4 7
فی کوشش کامیابی کی شرح 78.6% 73.8%
غیر مستحکم ٹیسٹ 2 6
آؤٹ پٹ ٹوکنز 1,201 1,317
ریزننگ ٹوکنز 30,056 177,502

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 216 1,421
Qwen: Qwen3.5-35B-A3B 10.00 10.00 100.0% 0 429 36,235
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 234 735
Qwen: Qwen3.5-35B-A3B 5.50 5.87 83.3% 1 235 19,493
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 4.00 7.21 55.6% 1 64 25,308
Qwen: Qwen3.5-35B-A3B 1.00 4.41 44.5% 2 41 46,368
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 9.00 10.00 50.0% 0 93 693
Qwen: Qwen3.5-35B-A3B 8.00 6.80 66.7% 1 97 17,361
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 7.00 7.38 77.8% 1 340 1,407
Qwen: Qwen3.5-35B-A3B 4.33 4.70 66.7% 2 206 56,680
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 254 492
Qwen: Qwen3.5-35B-A3B 10.00 10.00 100.0% 0 309 1,365

موازنہ کی جوڑی تبدیل کریں