नेव्हिगेशन
AI BENCHY
Advertise here

Kimi K2.5 (medium) vs Grok 4.3 (medium)

Grok 4.3 (medium) average score मध्ये पुढे आहे: 7.1 vs 7.0. Kimi K2.5 (medium) चा benchmark खर्च कमी आहे: $0.600 vs $0.779. Grok 4.3 (medium) वेगवान आहे: 47.45s vs 99.00s, pass rates 65.2% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#87
एकूण आउटपुट टोकन्स
227,367
प्रतिसाद वेळ (सरासरी)
99.00s
एकूण खर्च
$0.600
क्रमांक
#83
एकूण आउटपुट टोकन्स
241,421
प्रतिसाद वेळ (सरासरी)
47.45s
एकूण खर्च
$0.779
शिफारस केलेले मॉडेल Grok 4.3 (medium)

It has the best score here (7.1), while responding about 2.1x faster than Kimi K2.5 (medium).

तपशीलवार तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium प्रकाशन: 2026-01-27 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.0 7.1
क्रमांक #87 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 7.0 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 68.2%
अस्थिर चाचण्या 8 4
एकूण रन 66 66
प्रति निकाल खर्च 4.789 5.990
एकूण खर्च $0.600 $0.779
इनपुट किंमत $0.571 / 1M $1.250 / 1M
आउटपुट किंमत $2.850 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 118,448 140,031
आउटपुट टोकन्स 62,124 13,739
रिझनिंग टोकन्स 165,243 227,682
प्रतिसाद वेळ (सरासरी) 99.00s 47.45s
प्रतिसाद वेळ (कमाल) 281.00s 216.69s
प्रतिसाद वेळ (एकूण) 1485.04s 1043.83s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 MoonshotAI: Kimi K2.5

medium
खर्च
$0.030
वेळ
58.6s
टोकन्स
8,683 tok

#83 xAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला