نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.3-Codex

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک Anthropic: Claude Sonnet 4.6 medium اجرا: ریلیز کی تاریخ نامعلوم OpenAI: GPT-5.3-Codex medium اجرا: ریلیز کی تاریخ نامعلوم
درجہ #8 #7
اسکور 7.43 7.93
تسلسل 9.40 8.84
فی نتیجہ لاگت 8.105 4.641
کل لاگت $0.811 $0.465
درست ٹیسٹس
غلط ٹیسٹس 4 4
فی کوشش کامیابی کی شرح 73.8% 78.6%
غیر مستحکم ٹیسٹ 1 2
آؤٹ پٹ ٹوکنز 29,098 1,201
ریزننگ ٹوکنز 20,435 30,056

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 7.00 10.00 66.7% 0 1,031 1,093
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 216 1,421
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 727 907
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 234 735
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 1.00 7.21 11.1% 1 25,790 16,919
OpenAI: GPT-5.3-Codex 4.00 7.21 55.6% 1 64 25,308
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 316 523
OpenAI: GPT-5.3-Codex 9.00 10.00 50.0% 0 93 693
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 579 642
OpenAI: GPT-5.3-Codex 7.00 7.38 77.8% 1 340 1,407
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 655 351
OpenAI: GPT-5.3-Codex 10.00 10.00 100.0% 0 254 492

موازنہ کی جوڑی تبدیل کریں