नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Grok 4.20 Beta

सारांश

Nemotron 3 Ultra 550b A55b vs Grok 4.20 Beta benchmark तुलना: Nemotron 3 Ultra 550b A55b average score मध्ये पुढे आहे: 7.5 vs 5.8. Grok 4.20 Beta चा benchmark खर्च कमी आहे: $0.087 vs $0.177. Grok 4.20 Beta वेगवान आहे: 1.19s vs 15.05s, pass rates 69.8% vs 37.0%.

शिफारस केलेले मॉडेल: Grok 4.20 Beta - It offers the best overall trade-off: a competitive score (5.8), lower cost than Nemotron 3 Ultra 550b A55b, and balanced response time.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-10

मेट्रिक Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium प्रकाशन: 2026-06-04 मोफत उपलब्ध Grok 4.20 Beta Grok 4.20 Beta none प्रकाशन: 2026-03-12
स्कोअर 7.5 5.8
क्रमांक #42 #107
विश्वसनीयता 9.7 लागू नाही
सुसंगतता 8.8 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.8% 37.0%
अस्थिर चाचण्या 3 1
एकूण रन 63 52
प्रति निकाल खर्च 0.000 1.510
एकूण खर्च $0.177 $0.087
इनपुट किंमत $0.500 / 1M $2.041 / 1M
आउटपुट किंमत $2.500 / 1M $2.041 / 1M
एकूण इनपुट टोकन्स 46,813 40,597
आउटपुट टोकन्स 18,002 1,657
रिझनिंग टोकन्स 53,091 0
प्रतिसाद वेळ (सरासरी) 15.05s 1.19s
प्रतिसाद वेळ (कमाल) 43.93s 6.48s
प्रतिसाद वेळ (एकूण) 316.09s 21.43s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Nemotron 3 Ultra 550b A55b

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#107 Grok 4.20 Beta

none
Invalid SVG
Cost
$0.004
Time
8.5s
Tokens
1,672 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 1,986 251 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 358 74 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 17,673 282 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 7,749 197 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 1,746 160 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 819 87 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Grok 4.20 Beta 6.3 10.0 50.0% 0 649ms 1,350 60 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Grok 4.20 Beta 7.7 10.0 66.7% 0 586ms 1,671 357 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 7,245 189 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
Grok 4.20 Beta - - - - - - - - -

झटपट तुलना

तुलना जोडी बदला