نیویگیشن
AI BENCHY
موازنہ کریں چارٹس طریقہ کار
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Trinity Large Preview vs MoonshotAI: Kimi K2.5

موازنہ کریں:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-06

میٹرک Trinity Large Preview none اجرا: 2026-01-27 مفت دستیاب MoonshotAI: Kimi K2.5 medium اجرا: 2026-01-27
درجہ #45 #28
اوسط اسکور 4.2 6.4
تسلسل 9.6 7.5
فی نتیجہ لاگت 0.000 2.171
کل لاگت $0.000 $0.196
درست ٹیسٹس
فی کوشش کامیابی کی شرح 33.3% 72.9%
غیر مستحکم ٹیسٹ 1 5
کل رنز 48 48
آؤٹ پٹ ٹوکنز 1,837 38,453
ریزننگ ٹوکنز 0 72,496
ردِعمل کا وقت (اوسط) 3.15s 69.83s
ردِعمل کا وقت (زیادہ سے زیادہ) 8.91s 137.29s
ردِعمل کا وقت (کل) 50.46s 628.45s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 0.0% 0 3.59s 587 0
MoonshotAI: Kimi K2.5 7.0 7.2 88.9% 1 85.28s 335 6,255
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 0.0% 0 8.91s 294 0
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 9.9 10.0 100.0% 0 3.26s 186 0
MoonshotAI: Kimi K2.5 9.9 10.0 100.0% 0 49.78s 563 7,940
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 4.0 10.0 33.3% 0 877ms 25 0
MoonshotAI: Kimi K2.5 10.0 4.4 33.3% 2 137.29s 20,753 30,564
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 3.0 9.9 0.0% 0 2.86s 124 0
MoonshotAI: Kimi K2.5 6.0 3.4 66.7% 1 69.73s 3,815 4,262
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 3.5 6.7 16.7% 1 1.09s 63 0
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 4.0 10.0 33.3% 0 3.30s 291 0
MoonshotAI: Kimi K2.5 4.0 7.3 44.4% 1 45.40s 6,671 12,403
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں