Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Nemotron 3 Nano Omni 30b A3b Reasoning

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-29

Metrică Mercury 2 Mercury 2 none Lansare: 2026-02-24 Nemotron 3 Nano Omni 30b A3b Reasoning Nemotron 3 Nano Omni 30b A3b Reasoning medium Lansare: 2026-04-28 Disponibil gratuit
Scor 4.8 5.2
Rang #121 #107
Fiabilitate N/D 10.0
Consistență 9.0 5.9
Teste corecte
Rată de trecere pe încercare 27.8% 47.9%
Teste instabile 2 8
Rulări totale 54 54
Cost per rezultat 0.165 0.000
Cost total $0.007 $0.000
Preț de intrare $0.250 / 1M $0.000 / 1M
Preț de ieșire $0.750 / 1M $0.000 / 1M
Tokenuri de ieșire 1,625 50,628
Tokenuri de raționament 0 184,655
Timp de răspuns (mediu) 613ms 14.46s
Timp de răspuns (maxim) 1.27s 147.45s
Timp de răspuns (total) 11.04s 231.37s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.0 5.9 75.0% 2 2.17s 2,490 3,481
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.3 1.7 33.3% 1 38.09s 6,097 30,508
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.3 5.9 83.3% 1 2.72s 890 2,811
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Nemotron 3 Nano Omni 30b A3b Reasoning 2.9 7.2 11.1% 1 56.67s 40,404 142,623
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Nemotron 3 Nano Omni 30b A3b Reasoning 4.8 9.9 0.0% 0 1.43s 41 850
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Nemotron 3 Nano Omni 30b A3b Reasoning 6.9 6.3 66.7% 1 1.53s 192 1,728
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.5 4.4 33.3% 2 1.56s 514 2,654
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0

Comparație rapidă

Schimbă perechea de comparație