नेविगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs Laguna S 2.1 (low)

Mistral Small 4 (medium) average score में आगे है: 5.1 vs 5.0. Laguna S 2.1 (low) की benchmark लागत कम है: $0.082 vs $0.097. Mistral Small 4 (medium) तेज है: 10.80s vs 85.34s, pass rates 43.9% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#257
कुल आउटपुट टोकन
133,597
प्रतिक्रिया समय (औसत)
10.80s
कुल लागत
$0.097
रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
अनुशंसित मॉडल Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 7.9x faster than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16 Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.1 5.0
रैंक #257 #266
विश्वसनीयता 10.0 10.0
संगति 7.0 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 43.9% 22.7%
अस्थिर टेस्ट 8 5
कुल रन 66 66
प्रति परिणाम लागत 1.923 3.022
कुल लागत $0.097 $0.082
इनपुट कीमत $0.150 / 1M $0.090 / 1M
आउटपुट कीमत $0.600 / 1M $0.180 / 1M
कुल इनपुट टोकन 140,559 118,752
आउटपुट टोकन 40,268 67,823
रीजनिंग टोकन 93,329 383,885
प्रतिक्रिया समय (औसत) 10.80s 85.34s
प्रतिक्रिया समय (अधिकतम) 59.15s 814.73s
प्रतिक्रिया समय (कुल) 237.60s 1877.49s
पैरामीटर 119B कुल (6B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#257 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

त्वरित तुलना

तुलना जोड़ी बदलें