AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Mimo V2 PRO

Resumo

Comparação benchmark Nemotron 3 Ultra 550b A55b vs Mimo V2 PRO: Nemotron 3 Ultra 550b A55b lidera na pontuação média com 8.1 vs 6.7. Nemotron 3 Ultra 550b A55b tem menor custo de benchmark com $0.158 vs $0.333. Nemotron 3 Ultra 550b A55b é mais rápido com 15.05s vs 22.16s, com taxas de acerto de 69.8% vs 73.0%.

Modelo recomendado: Nemotron 3 Ultra 550b A55b - Tem a melhor pontuação aqui (8.1) e custa cerca de 2.1x menos que Mimo V2 PRO.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-18

Métrica	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lançamento: 2026-06-04 Disponível grátis	Mimo V2 PRO Mimo V2 PRO medium Lançamento: 2026-03-18

Métrica	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lançamento: 2026-06-04 Disponível grátis	Mimo V2 PRO Mimo V2 PRO medium Lançamento: 2026-03-18
Pontuação	8.1	6.7
Posição	#26	#77
Confiabilidade	9.7	9.6
Consistência	8.8	8.0
Testes corretos
Taxa de acerto por tentativa	69.8%	73.0%
Testes instáveis	3	5
Execuções totais	63	63
Custo por resultado	0.000	2.450
Custo total	$0.158	$0.333
Preço de entrada	$0.500 / 1M	$2.653 / 1M
Preço de saída	$2.200 / 1M	$2.653 / 1M
Total de tokens de entrada	46,813	40,961
Tokens de saída	18,002	2,518
Tokens de raciocínio	53,091	81,801
Tempo de resposta (médio)	15.05s	22.16s
Tempo de resposta (máx.)	43.93s	136.29s
Tempo de resposta (total)	316.09s	443.22s

Geração showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium

SVG inválido

Custo: $0.000
Tempo: 300.0s
Tokens: 0 tok

#77 Mimo V2 PRO

medium

This model has been deprecated. It is recommended to migrate to xiaomi/mimo-v2.5-pro

Custo: $0.000
Tempo: 0.1s
Tokens: 0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Mimo V2 PRO	10.0	10.0	100.0%	0		2.86s	621	251	1,154

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Mimo V2 PRO	6.0	7.4	55.6%	1		94.21s	4,787	527	37,424

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Mimo V2 PRO	4.7	1.6	66.7%	1		64.71s	17,028	380	14,186

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Mimo V2 PRO	7.3	5.8	83.3%	1		17.20s	7,746	260	7,484

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Mimo V2 PRO	5.3	10.0	33.3%	0		8.82s	525	170	2,158

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Mimo V2 PRO	10.0	10.0	100.0%	0		4.92s	492	184	400

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Mimo V2 PRO	9.9	10.0	100.0%	0		3.36s	672	83	667

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Mimo V2 PRO	6.4	4.4	77.8%	2		5.08s	660	372	1,622

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Mimo V2 PRO	10.0	10.0	100.0%	0		8.19s	8,220	263	864

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Mimo V2 PRO	3.0	10.0	0.0%	0		82.71s	210	28	15,842

Comparação rápida

Trocar par de comparação