नेविगेशन
Advertise here

Kimi K3 (max) vs Qwen3.8 27B (medium)

Kimi K3 (max) average score में आगे है: 7.9 vs 7.8. Qwen3.8 27B (medium) की benchmark लागत कम है: ~$0.058 vs $3.467. Qwen3.8 27B (medium) तेज है: 33.05s vs 142.84s, pass rates 77.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#90
कुल आउटपुट टोकन
224,128
प्रतिक्रिया समय (औसत)
142.84s
कुल लागत
$3.467
रैंक
#101
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
~$0.058
अनुशंसित मॉडल Qwen3.8 27B (medium)

Its score stays close to the best score here (7.8 vs 7.9), while costing about 60.6x less than Kimi K3 (max).

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.9 7.8
रैंक #90 #101
विश्वसनीयता 9.0 9.6
संगति 9.2 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 66.7%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 21.668 ~0.409
कुल लागत $3.467 ~$0.058
इनपुट कीमत $3.000 / 1M लागू नहीं
आउटपुट कीमत $15.000 / 1M लागू नहीं
कुल इनपुट टोकन 34,960 98,266
आउटपुट टोकन 2,887 1,861
रीजनिंग टोकन 221,241 134,301
प्रतिक्रिया समय (औसत) 142.84s 33.05s
प्रतिक्रिया समय (अधिकतम) 766.58s 214.63s
प्रतिक्रिया समय (कुल) 2714.02s 694.04s
पैरामीटर 2.8T कुल (104B सक्रिय) 27.3B
उपलब्धता वेट उपलब्ध वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#101 Qwen3.8 27B

medium
लागत
~$0.002
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें