नेविगेशन
AI BENCHY
Advertise here

Kimi K3 (max) vs GLM 5.2 (medium)

Kimi K3 (max) average score में आगे है: 7.9 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.276 vs $3.467. GLM 5.2 (medium) तेज है: 23.28s vs 142.84s, pass rates 77.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#59
कुल आउटपुट टोकन
224,128
प्रतिक्रिया समय (औसत)
142.84s
कुल लागत
$3.467
रैंक
#66
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.276
अनुशंसित मॉडल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 7.9), while costing about 12.6x less than Kimi K3 (max).

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.9 7.8
रैंक #59 #66
विश्वसनीयता 9.0 9.5
संगति 9.2 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 80.3%
अस्थिर टेस्ट 2 4
कुल रन 66 63
प्रति परिणाम लागत 21.668 2.159
कुल लागत $3.467 $0.276
इनपुट कीमत $3.000 / 1M $1.190 / 1M
आउटपुट कीमत $15.000 / 1M $3.740 / 1M
कुल इनपुट टोकन 34,960 37,199
आउटपुट टोकन 2,887 12,261
रीजनिंग टोकन 221,241 49,500
प्रतिक्रिया समय (औसत) 142.84s 23.28s
प्रतिक्रिया समय (अधिकतम) 766.58s 101.36s
प्रतिक्रिया समय (कुल) 2714.02s 488.94s
पैरामीटर 2.8T कुल (104B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#66 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें