नेविगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs GPT-4o-mini

Mistral Small 4 (medium) average score में आगे है: 5.1 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.010 vs $0.096. GPT-4o-mini तेज है: 1.99s vs 10.77s, pass rates 42.4% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#187
कुल आउटपुट टोकन
131,824
प्रतिक्रिया समय (औसत)
10.77s
कुल लागत
$0.096
रैंक
#195
कुल आउटपुट टोकन
2,911
प्रतिक्रिया समय (औसत)
1.99s
कुल लागत
$0.010
अनुशंसित मॉडल GPT-4o-mini

Its score stays close to the best score here (5.0 vs 5.1), while costing about 9.8x less than Mistral Small 4 (medium).

विस्तृत तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16 GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18
स्कोर 5.1 5.0
रैंक #187 #195
विश्वसनीयता 10.0 10.0
संगति 7.0 9.9
सही परीक्षण
प्रति प्रयास पास दर 42.4% 22.7%
अस्थिर टेस्ट 8 0
कुल रन 66 66
प्रति परिणाम लागत 1.913 0.195
कुल लागत $0.096 $0.010
इनपुट कीमत $0.150 / 1M $0.150 / 1M
आउटपुट कीमत $0.600 / 1M $0.600 / 1M
कुल इनपुट टोकन 140,494 53,136
आउटपुट टोकन 39,462 2,911
रीजनिंग टोकन 92,362 0
प्रतिक्रिया समय (औसत) 10.77s 1.99s
प्रतिक्रिया समय (अधिकतम) 59.15s 7.58s
प्रतिक्रिया समय (कुल) 236.94s 29.86s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

#195 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

त्वरित तुलना

तुलना जोड़ी बदलें