نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs MoonshotAI: Kimi K2.5

موازنہ کریں:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-05

میٹرک Inception: Mercury 2 none اجرا: 2026-02-24 MoonshotAI: Kimi K2.5 medium اجرا: 2026-01-27
درجہ #50 #29
اوسط اسکور 34 64
تسلسل 89 78
فی نتیجہ لاگت 0.147 2.082
کل لاگت $0.006 $0.188
ردِعمل کا وقت (اوسط) 594ms 69.84s
ردِعمل کا وقت (زیادہ سے زیادہ) 1.27s 137.29s
ردِعمل کا وقت (کل) 8.91s 558.72s
درست ٹیسٹس
فی کوشش کامیابی کی شرح 33.3% 73.3%
غیر مستحکم ٹیسٹ 2 4
آؤٹ پٹ ٹوکنز 1,144 34,638
ریزننگ ٹوکنز 0 68,234

اسکور کے لحاظ سے سرفہرست ماڈلز

ردِعمل کا وقت (اوسط)

اسکور بمقابلہ کل لاگت

اوسط اسکور vs ردِعمل کا وقت (اوسط)

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 100 100 0.0% 0 466ms 274 0
MoonshotAI: Kimi K2.5 70 72 88.9% 1 85.28s 335 6,255
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 100 100 0.0% 0 606ms 131 0
MoonshotAI: Kimi K2.5 100 100 100.0% 0 71.37s 703 3,713
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 55 59 83.3% 1 667ms 180 0
MoonshotAI: Kimi K2.5 99 100 100.0% 0 49.78s 563 7,940
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 40 72 44.4% 1 534ms 46 0
MoonshotAI: Kimi K2.5 100 44 33.3% 2 137.29s 20,753 30,564
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 55 100 50.0% 0 551ms 82 0
MoonshotAI: Kimi K2.5 100 100 100.0% 0 92.47s 5,371 6,547
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 100 100 0.0% 0 533ms 234 0
MoonshotAI: Kimi K2.5 40 73 44.4% 1 45.40s 6,671 12,403
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Inception: Mercury 2 100 100 100.0% 0 1.27s 197 0
MoonshotAI: Kimi K2.5 100 100 100.0% 0 31.74s 242 812

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں