Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Nemotron 3 Nano Omni 30b A3b Reasoning

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-29

Métrica Mercury 2 Mercury 2 none Lançamento: 2026-02-24 Nemotron 3 Nano Omni 30b A3b Reasoning Nemotron 3 Nano Omni 30b A3b Reasoning medium Lançamento: 2026-04-28 Disponível grátis
Pontuação 4.8 5.2
Posição #121 #107
Confiabilidade N/D 10.0
Consistência 9.0 5.9
Testes corretos
Taxa de acerto por tentativa 27.8% 47.9%
Testes instáveis 2 8
Execuções totais 54 54
Custo por resultado 0.165 0.000
Custo total $0.007 $0.000
Preço de entrada $0.250 / 1M $0.000 / 1M
Preço de saída $0.750 / 1M $0.000 / 1M
Tokens de saída 1,625 50,628
Tokens de raciocínio 0 184,655
Tempo de resposta (médio) 613ms 14.46s
Tempo de resposta (máx.) 1.27s 147.45s
Tempo de resposta (total) 11.04s 231.37s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.0 5.9 75.0% 2 2.17s 2,490 3,481
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.3 1.7 33.3% 1 38.09s 6,097 30,508
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.3 5.9 83.3% 1 2.72s 890 2,811
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Nemotron 3 Nano Omni 30b A3b Reasoning 2.9 7.2 11.1% 1 56.67s 40,404 142,623
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Nemotron 3 Nano Omni 30b A3b Reasoning 4.8 9.9 0.0% 0 1.43s 41 850
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Nemotron 3 Nano Omni 30b A3b Reasoning 6.9 6.3 66.7% 1 1.53s 192 1,728
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.5 4.4 33.3% 2 1.56s 514 2,654
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0

Comparação rápida

Trocar par de comparação