नेविगेशन
Advertise here

Kimi K3 (max) vs Grok 4.5 (high)

Kimi K3 (max) average score में आगे है: 8.3 vs 8.2. Grok 4.5 (high) की benchmark लागत कम है: $2.571 vs $4.013. Grok 4.5 (high) तेज है: 72.50s vs 139.41s, pass rates 78.3% vs 82.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#78
कुल आउटपुट टोकन
233,327
प्रतिक्रिया समय (औसत)
139.41s
कुल लागत
$4.013
रैंक
#82
कुल आउटपुट टोकन
333,632
प्रतिक्रिया समय (औसत)
72.50s
कुल लागत
$2.571
अनुशंसित मॉडल Grok 4.5 (high)

Its score stays close to the best score here (8.2 vs 8.3), while costing about 1.6x less than Kimi K3 (max).

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 8.3 8.2
रैंक #78 #82
विश्वसनीयता 9.3 10.0
संगति 9.3 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 82.6%
अस्थिर टेस्ट 2 3
कुल रन 69 69
प्रति परिणाम लागत 23.601 15.123
कुल लागत $4.013 $2.571
इनपुट कीमत $3.000 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 170,700 342,124
आउटपुट टोकन 7,719 7,135
रीजनिंग टोकन 225,608 326,497
प्रतिक्रिया समय (औसत) 139.41s 72.50s
प्रतिक्रिया समय (अधिकतम) 766.58s 676.83s
प्रतिक्रिया समय (कुल) 2788.26s 1667.51s
पैरामीटर 2.8T कुल (104B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#82 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें