नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Mistral: Mistral Small 4 vs Nemotron 3 Super 120b A12b

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-17

मेट्रिक Mistral Small 4 Mistral Small 4 none रिलीज़: 2026-03-16 Nemotron 3 Super 120b A12b Nemotron 3 Super 120b A12b none रिलीज़: 2026-03-11 निःशुल्क उपलब्ध
रैंक #61 #62
स्कोर 5.3 5.2
संगति 9.5 8.6
प्रति परिणाम लागत 0.108 0.000
कुल लागत $0.006 $0.000
सही परीक्षण
प्रति प्रयास पास दर 33.3% 35.3%
अस्थिर टेस्ट 1 3
कुल रन 51 49
आउटपुट टोकन 1,624 4,225
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 629ms 8.86s
प्रतिक्रिया समय (अधिकतम) 1.72s 24.97s
प्रतिक्रिया समय (कुल) 10.70s 150.70s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.4 7.9 16.7% 1 395ms 182 0
Nemotron 3 Super 120b A12b 4.8 10.0 25.0% 0 7.43s 2,174 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 496 0
Nemotron 3 Super 120b A12b 3.0 10.0 0.0% 0 19.98s 124 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 10.0 10.0 100.0% 0 822ms 261 0
Nemotron 3 Super 120b A12b 10.0 10.0 100.0% 0 7.92s 249 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 5.3 10.0 33.3% 0 367ms 28 0
Nemotron 3 Super 120b A12b 3.6 7.2 22.2% 1 6.23s 26 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.0 10.0 0.0% 0 729ms 205 0
Nemotron 3 Super 120b A12b 4.2 9.9 0.0% 0 24.97s 170 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 6.5 10.0 50.0% 0 380ms 69 0
Nemotron 3 Super 120b A12b 4.9 6.9 33.3% 1 1.50s 66 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.1 9.9 0.0% 0 589ms 170 0
Nemotron 3 Super 120b A12b 5.7 10.0 33.3% 0 7.50s 1,135 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 213 0
Nemotron 3 Super 120b A12b 4.7 1.6 66.7% 1 16.00s 281 0

त्वरित तुलना

तुलना जोड़ी बदलें