नेविगेशन
AI BENCHY
Advertise here

Kimi K2.6 (medium) vs Grok 4.3 (medium)

Kimi K2.6 (medium) average score में आगे है: 7.2 vs 7.1. Grok 4.3 (medium) की benchmark लागत कम है: $0.779 vs $0.831. Grok 4.3 (medium) तेज है: 47.45s vs 109.98s, pass rates 63.6% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#78
कुल आउटपुट टोकन
391,540
प्रतिक्रिया समय (औसत)
109.98s
कुल लागत
$0.831
रैंक
#83
कुल आउटपुट टोकन
241,421
प्रतिक्रिया समय (औसत)
47.45s
कुल लागत
$0.779
अनुशंसित मॉडल Grok 4.3 (medium)

Its score stays close to the best score here (7.1 vs 7.2), while responding about 2.3x faster than Kimi K2.6 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.2 7.1
रैंक #78 #83
विश्वसनीयता 9.4 10.0
संगति 8.3 8.6
सही परीक्षण
प्रति प्रयास पास दर 63.6% 68.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 9.821 5.990
कुल लागत $0.831 $0.779
इनपुट कीमत $0.646 / 1M $1.250 / 1M
आउटपुट कीमत $2.720 / 1M $2.500 / 1M
कुल इनपुट टोकन 68,902 140,031
आउटपुट टोकन 111,680 13,739
रीजनिंग टोकन 279,860 227,682
प्रतिक्रिया समय (औसत) 109.98s 47.45s
प्रतिक्रिया समय (अधिकतम) 876.20s 216.69s
प्रतिक्रिया समय (कुल) 2309.56s 1043.83s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

#83 xAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें