नेविगेशन
AI BENCHY
Advertise here

Laguna S 2.1 (low) vs MiMo-V2.5

MiMo-V2.5 average score में आगे है: 5.1 vs 5.0. MiMo-V2.5 की benchmark लागत कम है: $0.025 vs $0.082. MiMo-V2.5 तेज है: 4.68s vs 85.34s, pass rates 22.7% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
रैंक
#260
कुल आउटपुट टोकन
16,464
प्रतिक्रिया समय (औसत)
4.68s
कुल लागत
$0.025
अनुशंसित मॉडल MiMo-V2.5

It has the best score here (5.1), while costing about 3.3x less than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध MiMo-V2.5 MiMo-V2.5 none रिलीज़: 2026-04-22
स्कोर 5.0 5.1
रैंक #266 #260
विश्वसनीयता 10.0 10.0
संगति 8.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 22.7% 27.3%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 3.022 0.769
कुल लागत $0.082 $0.025
इनपुट कीमत $0.090 / 1M $0.140 / 1M
आउटपुट कीमत $0.180 / 1M $0.280 / 1M
कुल इनपुट टोकन 118,752 141,052
आउटपुट टोकन 67,823 16,464
रीजनिंग टोकन 383,885 0
प्रतिक्रिया समय (औसत) 85.34s 4.68s
प्रतिक्रिया समय (अधिकतम) 814.73s 55.36s
प्रतिक्रिया समय (कुल) 1877.49s 103.02s
पैरामीटर 118B कुल (8B सक्रिय) 310B कुल (15B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

#260 MiMo-V2.5

none
लागत
$0.007
समय
267.4s
टोकन
25,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
MiMo-V2.5 5.5 10.0 33.3% 0 3.24s 7,440 696 0

त्वरित तुलना

तुलना जोड़ी बदलें