नेविगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs GPT-5.4 Nano

Mistral Small 4 (medium) average score में आगे है: 5.1 vs 4.8. GPT-5.4 Nano की benchmark लागत कम है: $0.041 vs $0.096. GPT-5.4 Nano तेज है: 2.57s vs 10.77s, pass rates 42.4% vs 28.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#200
कुल आउटपुट टोकन
131,824
प्रतिक्रिया समय (औसत)
10.77s
कुल लागत
$0.096
रैंक
#214
कुल आउटपुट टोकन
13,794
प्रतिक्रिया समय (औसत)
2.57s
कुल लागत
$0.041
अनुशंसित मॉडल GPT-5.4 Nano

Its score stays close to the best score here (4.8 vs 5.1), while costing about 2.4x less than Mistral Small 4 (medium).

विस्तृत तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16 GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17
स्कोर 5.1 4.8
रैंक #200 #214
विश्वसनीयता 10.0 10.0
संगति 7.0 8.2
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 42.4% 28.8%
अस्थिर टेस्ट 8 5
कुल रन 66 66
प्रति परिणाम लागत 1.913 1.011
कुल लागत $0.096 $0.041
इनपुट कीमत $0.150 / 1M $0.200 / 1M
आउटपुट कीमत $0.600 / 1M $1.250 / 1M
कुल इनपुट टोकन 140,494 115,924
आउटपुट टोकन 39,462 13,794
रीजनिंग टोकन 92,362 0
प्रतिक्रिया समय (औसत) 10.77s 2.57s
प्रतिक्रिया समय (अधिकतम) 59.15s 25.50s
प्रतिक्रिया समय (कुल) 236.94s 56.51s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#200 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

#214 GPT-5.4 Nano

none
लागत
$0.008
समय
46.1s
टोकन
5,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

त्वरित तुलना

तुलना जोड़ी बदलें