نیویگیشن
AI BENCHY
Your ad here

AI BENCHY Compare

Trinity Large Preview vs xAI: Grok 4.20 Beta

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-12

میٹرک Trinity Large Preview Trinity Large Preview none اجرا: 2026-01-27 مفت دستیاب Grok 4.20 Beta Grok 4.20 Beta none اجرا: 2026-03-12
درجہ #53 #52
اوسط اسکور 4.2 4.4
تسلسل 9.6 9.1
فی نتیجہ لاگت 0.000 2.214
کل لاگت $0.000 $0.089
درست ٹیسٹس
فی کوشش کامیابی کی شرح 33.3% 33.3%
غیر مستحکم ٹیسٹ 1 2
کل رنز 48 48
آؤٹ پٹ ٹوکنز 1,837 1,511
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 3.15s 1.22s
ردِعمل کا وقت (زیادہ سے زیادہ) 8.91s 6.48s
ردِعمل کا وقت (کل) 50.46s 19.53s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اوسط اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 0.0% 0 3.59s 587 0
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 0.0% 0 8.91s 294 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 9.9 10.0 100.0% 0 3.26s 186 0
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 4.0 10.0 33.3% 0 877ms 25 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 3.0 9.9 0.0% 0 2.86s 124 0
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 3.5 6.7 16.7% 1 1.09s 63 0
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 4.0 10.0 33.3% 0 3.30s 291 0
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں