نیویگیشن
AI BENCHY
موازنہ کریں چارٹس طریقہ کار
❤️ Made by XCS
Your ad here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.4

موازنہ کریں:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-06

میٹرک MoonshotAI: Kimi K2.5 medium اجرا: 2026-01-27 OpenAI: GPT-5.4 none اجرا: 2026-03-05
اوسط اسکور 6.4 4.6
درجہ #30 #45
درست ٹیسٹس
تسلسل 7.8 8.9
فی نتیجہ لاگت 2.082 1.496
کل لاگت $0.188 $0.090
فی کوشش کامیابی کی شرح 73.3% 44.4%
غیر مستحکم ٹیسٹ 4 2
common.totalRuns 45 (15 x 3) 45 (15 x 3)
آؤٹ پٹ ٹوکنز 34,638 1,635
ریزننگ ٹوکنز 68,234 0
ردِعمل کا وقت (اوسط) 69.84s 1.46s
ردِعمل کا وقت (زیادہ سے زیادہ) 137.29s 2.89s
ردِعمل کا وقت (کل) 558.72s 21.86s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 7.0 7.2 88.9% 1 85.28s 335 6,255
OpenAI: GPT-5.4 10.0 7.3 11.1% 1 1.41s 388 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
OpenAI: GPT-5.4 10.0 10.0 0.0% 0 2.89s 291 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 9.9 10.0 100.0% 0 49.78s 563 7,940
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 1.04s 222 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 10.0 4.4 33.3% 2 137.29s 20,753 30,564
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 1.07s 50 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
OpenAI: GPT-5.4 5.5 10.0 50.0% 0 1.07s 81 0
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 4.0 7.3 44.4% 1 45.40s 6,671 12,403
OpenAI: GPT-5.4 4.0 9.8 33.3% 0 1.52s 357 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
MoonshotAI: Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں