नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs Grok 4.3 (medium)

Grok 4.3 (medium) average score में आगे है: 6.5 vs 6.4. Kimi K2.5 (medium) की benchmark लागत कम है: $0.841 vs $0.989. Grok 4.3 (medium) तेज है: 44.53s vs 125.76s, pass rates 60.9% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-03

तुलना किए गए मॉडल

रैंक
#208
कुल आउटपुट टोकन
241,096
प्रतिक्रिया समय (औसत)
125.76s
कुल लागत
$0.841
रैंक
#202
कुल आउटपुट टोकन
232,542
प्रतिक्रिया समय (औसत)
44.53s
कुल लागत
$0.989
अनुशंसित मॉडल Grok 4.3 (medium)

It has the best score here (6.5), while responding about 2.8x faster than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 6.4 6.5
रैंक #208 #202
विश्वसनीयता 9.6 10.0
संगति 7.1 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 63.8%
अस्थिर टेस्ट 8 5
कुल रन 69 69
प्रति परिणाम लागत 6.085 8.235
कुल लागत $0.841 $0.989
इनपुट कीमत $0.450 / 1M $1.250 / 1M
आउटपुट कीमत $2.250 / 1M $2.500 / 1M
कैश पढ़ने की कीमत $0.070 / 1M $0.200 / 1M
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 292,271 325,471
आउटपुट टोकन 55,025 14,867
रीजनिंग टोकन 186,071 217,675
प्रतिक्रिया समय (औसत) 125.76s 44.53s
प्रतिक्रिया समय (अधिकतम) 566.79s 216.69s
प्रतिक्रिया समय (कुल) 2137.84s 1024.25s
पैरामीटर 1T कुल (32B सक्रिय) ~1.5T कुल (~150B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#202 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें