नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs Grok 4.3 (medium)

Grok 4.3 (medium) average score में आगे है: 7.1 vs 7.0. Kimi K2.5 (medium) की benchmark लागत कम है: $0.600 vs $0.779. Grok 4.3 (medium) तेज है: 47.45s vs 99.00s, pass rates 65.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#87
कुल आउटपुट टोकन
227,367
प्रतिक्रिया समय (औसत)
99.00s
कुल लागत
$0.600
रैंक
#83
कुल आउटपुट टोकन
241,421
प्रतिक्रिया समय (औसत)
47.45s
कुल लागत
$0.779
अनुशंसित मॉडल Grok 4.3 (medium)

It has the best score here (7.1), while responding about 2.1x faster than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.0 7.1
रैंक #87 #83
विश्वसनीयता 10.0 10.0
संगति 7.0 8.6
सही परीक्षण
प्रति प्रयास पास दर 65.2% 68.2%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 4.789 5.990
कुल लागत $0.600 $0.779
इनपुट कीमत $0.571 / 1M $1.250 / 1M
आउटपुट कीमत $2.850 / 1M $2.500 / 1M
कुल इनपुट टोकन 118,448 140,031
आउटपुट टोकन 62,124 13,739
रीजनिंग टोकन 165,243 227,682
प्रतिक्रिया समय (औसत) 99.00s 47.45s
प्रतिक्रिया समय (अधिकतम) 281.00s 216.69s
प्रतिक्रिया समय (कुल) 1485.04s 1043.83s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#83 xAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें