AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Mimo V2 Omni

Rezumat

Comparație benchmark Nemotron 3 Ultra 550b A55b vs Mimo V2 Omni: Nemotron 3 Ultra 550b A55b conduce la scorul mediu cu 8.1 vs 6.8. Nemotron 3 Ultra 550b A55b are costul de benchmark mai mic, $0.158 vs $0.683. Nemotron 3 Ultra 550b A55b este mai rapid cu 15.05s vs 41.16s, cu rate de reușită de 69.8% vs 55.6%.

Model recomandat: Nemotron 3 Ultra 550b A55b - Are cel mai bun scor aici (8.1) și costă de aproximativ 4.3x mai puțin decât Mimo V2 Omni.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lansare: 2026-06-04 Disponibil gratuit	Mimo V2 Omni Mimo V2 Omni medium Lansare: 2026-03-18

Metrică	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lansare: 2026-06-04 Disponibil gratuit	Mimo V2 Omni Mimo V2 Omni medium Lansare: 2026-03-18
Scor	8.1	6.8
Rang	#26	#73
Fiabilitate	9.7	10.0
Consistență	8.8	8.7
Teste corecte
Rată de trecere pe încercare	69.8%	55.6%
Teste instabile	3	3
Rulări totale	63	55
Cost per rezultat	0.000	7.334
Cost total	$0.158	$0.683
Preț de intrare	$0.500 / 1M	$1.722 / 1M
Preț de ieșire	$2.200 / 1M	$1.722 / 1M
Total tokenuri de intrare	46,813	37,007
Tokenuri de ieșire	18,002	1,952
Tokenuri de raționament	53,091	357,306
Timp de răspuns (mediu)	15.05s	41.16s
Timp de răspuns (maxim)	43.93s	299.23s
Timp de răspuns (total)	316.09s	823.26s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium

SVG invalid

Cost: $0.000
Timp: 300.0s
Tokenuri: 0 tok

#73 Mimo V2 Omni

medium

This model has been deprecated. It is recommended to migrate to xiaomi/mimo-v2.5

Cost: $0.000
Timp: 0.1s
Tokenuri: 0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Mimo V2 Omni	10.0	10.0	100.0%	0		2.75s	621	269	1,701

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Mimo V2 Omni	3.3	6.5	11.1%	1		183.89s	4,787	292	174,314

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Mimo V2 Omni	10.0	10.0	100.0%	0		25.87s	15,060	380	8,673

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Mimo V2 Omni	10.0	10.0	100.0%	0		3.04s	6,002	155	591

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Mimo V2 Omni	3.0	10.0	0.0%	0		47.89s	735	155	68,398

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Mimo V2 Omni	5.4	2.5	66.7%	1		3.61s	492	136	492

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Mimo V2 Omni	8.3	10.0	50.0%	0		4.99s	470	49	515

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Mimo V2 Omni	5.9	7.2	55.6%	1		2.38s	410	210	860

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Mimo V2 Omni	10.0	10.0	100.0%	0		13.98s	8,220	303	3,461

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Mimo V2 Omni	3.0	10.0	0.0%	0		234.19s	210	3	98,301

Comparație rapidă

Schimbă perechea de comparație