AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Mimo V2 PRO

Rezumat

Comparație benchmark Nemotron 3 Ultra 550b A55b vs Mimo V2 PRO: Nemotron 3 Ultra 550b A55b conduce la scorul mediu cu 8.1 vs 6.7. Nemotron 3 Ultra 550b A55b are costul de benchmark mai mic, $0.158 vs $0.333. Nemotron 3 Ultra 550b A55b este mai rapid cu 15.05s vs 22.16s, cu rate de reușită de 69.8% vs 73.0%.

Model recomandat: Nemotron 3 Ultra 550b A55b - Are cel mai bun scor aici (8.1) și costă de aproximativ 2.1x mai puțin decât Mimo V2 PRO.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lansare: 2026-06-04 Disponibil gratuit	Mimo V2 PRO Mimo V2 PRO medium Lansare: 2026-03-18

Metrică	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lansare: 2026-06-04 Disponibil gratuit	Mimo V2 PRO Mimo V2 PRO medium Lansare: 2026-03-18
Scor	8.1	6.7
Rang	#26	#77
Fiabilitate	9.7	9.6
Consistență	8.8	8.0
Teste corecte
Rată de trecere pe încercare	69.8%	73.0%
Teste instabile	3	5
Rulări totale	63	63
Cost per rezultat	0.000	2.450
Cost total	$0.158	$0.333
Preț de intrare	$0.500 / 1M	$2.653 / 1M
Preț de ieșire	$2.200 / 1M	$2.653 / 1M
Total tokenuri de intrare	46,813	40,961
Tokenuri de ieșire	18,002	2,518
Tokenuri de raționament	53,091	81,801
Timp de răspuns (mediu)	15.05s	22.16s
Timp de răspuns (maxim)	43.93s	136.29s
Timp de răspuns (total)	316.09s	443.22s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium

SVG invalid

Cost: $0.000
Timp: 300.0s
Tokenuri: 0 tok

#77 Mimo V2 PRO

medium

This model has been deprecated. It is recommended to migrate to xiaomi/mimo-v2.5-pro

Cost: $0.000
Timp: 0.1s
Tokenuri: 0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Mimo V2 PRO	10.0	10.0	100.0%	0		2.86s	621	251	1,154

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Mimo V2 PRO	6.0	7.4	55.6%	1		94.21s	4,787	527	37,424

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Mimo V2 PRO	4.7	1.6	66.7%	1		64.71s	17,028	380	14,186

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Mimo V2 PRO	7.3	5.8	83.3%	1		17.20s	7,746	260	7,484

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Mimo V2 PRO	5.3	10.0	33.3%	0		8.82s	525	170	2,158

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Mimo V2 PRO	10.0	10.0	100.0%	0		4.92s	492	184	400

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Mimo V2 PRO	9.9	10.0	100.0%	0		3.36s	672	83	667

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Mimo V2 PRO	6.4	4.4	77.8%	2		5.08s	660	372	1,622

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Mimo V2 PRO	10.0	10.0	100.0%	0		8.19s	8,220	263	864

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Mimo V2 PRO	3.0	10.0	0.0%	0		82.71s	210	28	15,842

Comparație rapidă

Schimbă perechea de comparație