नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Nemotron 3 Ultra 550b A55b vs OpenAI: GPT-4o-mini

सारांश

Nemotron 3 Ultra 550b A55b vs GPT-4o-mini benchmark तुलना: Nemotron 3 Ultra 550b A55b average score में आगे है: 8.1 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.006 vs $0.158. GPT-4o-mini तेज है: 1.77s vs 15.05s, pass rates 69.8% vs 23.8%.

अनुशंसित मॉडल: Nemotron 3 Ultra 550b A55b - It has the strongest score in this comparison (8.1) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium रिलीज़: 2026-06-04 निःशुल्क उपलब्ध GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18
स्कोर 8.1 5.0
रैंक #26 #144
विश्वसनीयता 9.7 10.0
संगति 8.8 9.9
सही परीक्षण
प्रति प्रयास पास दर 69.8% 23.8%
अस्थिर टेस्ट 3 0
कुल रन 63 63
प्रति परिणाम लागत 0.000 0.119
कुल लागत $0.158 $0.006
इनपुट कीमत $0.500 / 1M $0.150 / 1M
आउटपुट कीमत $2.200 / 1M $0.600 / 1M
कुल इनपुट टोकन 46,813 31,518
आउटपुट टोकन 18,002 1,982
रीजनिंग टोकन 53,091 0
प्रतिक्रिया समय (औसत) 15.05s 1.77s
प्रतिक्रिया समय (अधिकतम) 43.93s 7.58s
प्रतिक्रिया समय (कुल) 316.09s 24.80s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#144 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0

त्वरित तुलना

तुलना जोड़ी बदलें