Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs NVIDIA: Nemotron 3 Super

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-03

Métrica Mercury 2 Mercury 2 none Lançamento: 2026-02-24 Nemotron 3 Super Nemotron 3 Super medium Lançamento: 2026-03-11 Disponível grátis
Pontuação 4.6 5.9
Posição #153 #102
Confiabilidade 10.0 10.0
Consistência 9.1 9.2
Testes corretos
Taxa de acerto por tentativa 25.0% 43.3%
Testes instáveis 2 2
Execuções totais 60 60
Custo por resultado 0.216 0.004
Custo total $0.009 $0.019
Preço de entrada $0.250 / 1M $0.090 / 1M
Preço de saída $0.750 / 1M $0.450 / 1M
Total de tokens de entrada 25,515 36,614
Tokens de saída 3,001 14,505
Tokens de raciocínio 0 30,178
Tempo de resposta (médio) 614ms 20.87s
Tempo de resposta (máx.) 1.27s 87.80s
Tempo de resposta (total) 12.28s 375.66s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Nemotron 3 Super 8.3 10.0 75.0% 0 7.85s 686 748 1,305
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
Nemotron 3 Super 3.1 9.9 0.0% 0 62.38s 1,362 452 848
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Nemotron 3 Super 10.0 10.0 100.0% 0 87.80s 15,561 2,021 9,996
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Nemotron 3 Super 10.0 10.0 100.0% 0 18.16s 7,944 877 2,607
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Nemotron 3 Super 2.9 4.4 22.2% 2 16.19s 456 5,255 6,072
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Nemotron 3 Super 4.1 10.0 0.0% 0 6.91s 492 105 363
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Nemotron 3 Super 7.3 10.0 50.0% 0 6.97s 723 956 2,383
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Nemotron 3 Super 3.0 10.0 0.0% 0 3.15s 708 570 1,322
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Nemotron 3 Super 10.0 10.0 100.0% 0 39.75s 8,544 270 1,969
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Nemotron 3 Super 3.0 10.0 0.0% 0 55.32s 138 3,251 3,313

Comparação rápida

Trocar par de comparação