नेविगेशन
AI BENCHY
Advertise here

Kimi K3 (max) vs GPT-5.2 Chat

average score लगभग बराबर है: 7.9 vs 7.9. GPT-5.2 Chat की benchmark लागत कम है: $0.594 vs $3.467. GPT-5.2 Chat तेज है: 7.73s vs 142.84s, pass rates 77.3% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#59
कुल आउटपुट टोकन
224,128
प्रतिक्रिया समय (औसत)
142.84s
कुल लागत
$3.467
रैंक
#60
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.9), while costing about 5.8x less than Kimi K3 (max).

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 7.9 7.9
रैंक #59 #60
विश्वसनीयता 9.0 10.0
संगति 9.2 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 69.7%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 21.668 4.564
कुल लागत $3.467 $0.594
इनपुट कीमत $3.000 / 1M $1.750 / 1M
आउटपुट कीमत $15.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 34,960 101,104
आउटपुट टोकन 2,887 29,742
रीजनिंग टोकन 221,241 0
प्रतिक्रिया समय (औसत) 142.84s 7.73s
प्रतिक्रिया समय (अधिकतम) 766.58s 38.52s
प्रतिक्रिया समय (कुल) 2714.02s 162.40s
पैरामीटर 2.8T कुल (104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#60 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें