नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Poolside: Laguna XS 2.1

सारांश

Nemotron 3 Ultra 550b A55b vs Laguna XS 2.1 benchmark तुलना: Nemotron 3 Ultra 550b A55b average score मध्ये पुढे आहे: 8.1 vs 5.3. Laguna XS 2.1 चा benchmark खर्च कमी आहे: $0.003 vs $0.158. Laguna XS 2.1 वेगवान आहे: 722ms vs 15.05s, pass rates 69.8% vs 31.8%.

शिफारस केलेले मॉडेल: Nemotron 3 Ultra 550b A55b - It has the strongest score in this comparison (8.1) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-02

मेट्रिक Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium प्रकाशन: 2026-06-04 मोफत उपलब्ध Laguna XS 2.1 Laguna XS 2.1 none प्रकाशन: 2026-07-02 मोफत उपलब्ध
स्कोअर 8.1 5.3
क्रमांक #26 #128
विश्वसनीयता 9.7 10.0
सुसंगतता 8.8 9.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.8% 31.8%
अस्थिर चाचण्या 3 3
एकूण रन 63 63
प्रति निकाल खर्च 0.000 0.058
एकूण खर्च $0.158 $0.003
इनपुट किंमत $0.500 / 1M $0.060 / 1M
आउटपुट किंमत $2.200 / 1M $0.120 / 1M
एकूण इनपुट टोकन्स 46,813 41,148
आउटपुट टोकन्स 18,002 3,451
रिझनिंग टोकन्स 53,091 0
प्रतिसाद वेळ (सरासरी) 15.05s 722ms
प्रतिसाद वेळ (कमाल) 43.93s 2.30s
प्रतिसाद वेळ (एकूण) 316.09s 15.17s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#128 Laguna XS 2.1

none
खर्च
$0.001
वेळ
27.6s
टोकन्स
4,344 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Laguna XS 2.1 5.3 8.3 33.3% 1 755ms 774 1,015 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Laguna XS 2.1 3.0 10.0 0.0% 0 1.76s 14,197 402 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Laguna XS 2.1 10.0 10.0 100.0% 0 768ms 7,734 240 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Laguna XS 2.1 5.3 10.0 33.3% 0 364ms 834 14 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Laguna XS 2.1 5.0 10.0 0.0% 0 529ms 537 128 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Laguna XS 2.1 3.8 5.8 33.3% 1 364ms 638 50 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Laguna XS 2.1 3.0 10.0 0.0% 0 1.01s 771 730 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Laguna XS 2.1 10.0 10.0 100.0% 0 1.36s 7,413 300 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
Laguna XS 2.1 3.0 10.0 0.0% 0 254ms 255 10 0

झटपट तुलना

तुलना जोडी बदला