نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs MoonshotAI: Kimi K2.6

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-28

میٹرک Claude Opus 4.8 Claude Opus 4.8 none اجرا: 2026-05-28 Kimi K2.6 Kimi K2.6 medium اجرا: 2026-04-20 مفت دستیاب
اسکور 7.3 7.4
درجہ #63 #58
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.3
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.0% 70.8%
غیر مستحکم ٹیسٹ 2 4
کل رنز 60 60
فی نتیجہ لاگت 4.324 7.621
کل لاگت $0.519 $0.820
ان پٹ قیمت $5.000 / 1M $0.730 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $3.490 / 1M
آؤٹ پٹ ٹوکنز 8,098 102,208
ریزننگ ٹوکنز 0 229,120
ردِعمل کا وقت (اوسط) 3.51s 54.03s
ردِعمل کا وقت (زیادہ سے زیادہ) 17.73s 215.85s
ردِعمل کا وقت (کل) 70.19s 1026.57s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 7,115 8,934
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
Kimi K2.6 6.5 5.3 75.0% 1 118.23s 9,255 52,215
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 711 13,876
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 316 11,305
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 47,035 98,262
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 3,981 4,472
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 3,977 5,269
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
Kimi K2.6 6.0 7.4 55.6% 1 25.06s 13,860 17,599
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 248 1,011
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 15,710 16,177

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں