नेविगेशन
AI BENCHY
Advertise here

Kimi K2.5 vs Laguna S 2.1 (medium)

average score लगभग बराबर है: 5.4 vs 5.4. Laguna S 2.1 (medium) की benchmark लागत कम है: $0.053 vs $0.101. Kimi K2.5 तेज है: 18.03s vs 58.42s, pass rates 30.3% vs 24.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#243
कुल आउटपुट टोकन
26,643
प्रतिक्रिया समय (औसत)
18.03s
कुल लागत
$0.101
रैंक
#239
कुल आउटपुट टोकन
339,595
प्रतिक्रिया समय (औसत)
58.42s
कुल लागत
$0.053
अनुशंसित मॉडल Kimi K2.5

It has the best score here (5.4), while responding about 3.2x faster than Laguna S 2.1 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 none रिलीज़: 2026-01-27 Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.4 5.4
रैंक #243 #239
विश्वसनीयता 10.0 10.0
संगति 8.6 8.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 30.3% 24.2%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 2.278 1.451
कुल लागत $0.101 $0.053
इनपुट कीमत $0.450 / 1M $0.090 / 1M
आउटपुट कीमत $2.250 / 1M $0.180 / 1M
कुल इनपुट टोकन 89,320 86,647
आउटपुट टोकन 26,643 97,298
रीजनिंग टोकन 0 242,297
प्रतिक्रिया समय (औसत) 18.03s 58.42s
प्रतिक्रिया समय (अधिकतम) 102.83s 560.31s
प्रतिक्रिया समय (कुल) 288.42s 1285.26s
पैरामीटर 1T कुल (32B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता वेट उपलब्ध वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#243 MoonshotAI: Kimi K2.5

none
लागत
$0.015
समय
89.1s
टोकन
5,421 tok

#239 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

त्वरित तुलना

तुलना जोड़ी बदलें