नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

तुलना किए गए मॉडल

Kimi K3 (max) vs Kimi K2.6 (medium) vs GPT-5.6 Sol (medium) benchmark तुलना: GPT-5.6 Sol (medium) स्कोर में 9.4 के साथ आगे है। Kimi K2.6 (medium) विश्वसनीयता में 10.0 के साथ आगे है। GPT-5.6 Sol (medium) का कुल लागत सबसे कम है: $0.508. GPT-5.6 Sol (medium) 12.63s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#59
कुल आउटपुट टोकन
224,128
प्रतिक्रिया समय (औसत)
142.84s
कुल लागत
$3.467
रैंक
#107
कुल आउटपुट टोकन
347,519
प्रतिक्रिया समय (औसत)
115.89s
कुल लागत
$1.247
रैंक
#8
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 4.6x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 7.9 7.2 9.4
रैंक #59 #107 #8
विश्वसनीयता 9.0 10.0 10.0
संगति 9.2 8.3 8.9
प्रयास 66/66 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 63.6% 90.9%
अस्थिर टेस्ट 2 4 3
कुल रन 66 66 66
प्रति परिणाम लागत 21.668 10.029 8.025
कुल लागत $3.467 $1.247 $0.508
इनपुट कीमत $3.000 / 1M $0.950 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $4.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 34,960 68,913 79,006
आउटपुट टोकन 2,887 64,654 4,696
रीजनिंग टोकन 221,241 282,865 30,281
प्रतिक्रिया समय (औसत) 142.84s 115.89s 12.63s
प्रतिक्रिया समय (अधिकतम) 766.58s 876.20s 79.40s
प्रतिक्रिया समय (कुल) 2714.02s 2433.66s 277.88s
पैरामीटर 2.8T कुल (104B सक्रिय) 1T कुल (32B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता वेट उपलब्ध वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#107 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें