نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs Grok 4.3 (medium)

Grok 4.3 (medium) average score میں آگے ہے: 7.1 vs 7.0. Kimi K2.5 (medium) کی benchmark لاگت کم ہے: $0.600 vs $0.779. Grok 4.3 (medium) تیز ہے: 47.45s vs 99.00s، pass rates 65.2% vs 68.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-28

درجہ
#87
کل آؤٹ پٹ ٹوکنز
227,367
ردِعمل کا وقت (اوسط)
99.00s
کل لاگت
$0.600
درجہ
#83
کل آؤٹ پٹ ٹوکنز
241,421
ردِعمل کا وقت (اوسط)
47.45s
کل لاگت
$0.779
تجویز کردہ ماڈل Grok 4.3 (medium)

It has the best score here (7.1), while responding about 2.1x faster than Kimi K2.5 (medium).

تفصیلی موازنہ

میٹرک Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 7.0 7.1
درجہ #87 #83
اعتماد پذیری 10.0 10.0
تسلسل 7.0 8.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 68.2%
غیر مستحکم ٹیسٹ 8 4
کل رنز 66 66
فی نتیجہ لاگت 4.789 5.990
کل لاگت $0.600 $0.779
ان پٹ قیمت $0.571 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $2.850 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 118,448 140,031
آؤٹ پٹ ٹوکنز 62,124 13,739
ریزننگ ٹوکنز 165,243 227,682
ردِعمل کا وقت (اوسط) 99.00s 47.45s
ردِعمل کا وقت (زیادہ سے زیادہ) 281.00s 216.69s
ردِعمل کا وقت (کل) 1485.04s 1043.83s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 MoonshotAI: Kimi K2.5

medium
لاگت
$0.030
وقت
58.6s
ٹوکنز
8,683 tok

#83 xAI: Grok 4.3

medium
لاگت
$0.009
وقت
19.0s
ٹوکنز
3,661 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں