Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Nemotron 3 Nano Omni 30b A3b Reasoning

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-29

Metrică Mercury 2 Mercury 2 none Lansare: 2026-02-24 Nemotron 3 Nano Omni 30b A3b Reasoning Nemotron 3 Nano Omni 30b A3b Reasoning none Lansare: 2026-04-28 Disponibil gratuit
Scor 4.8 4.4
Rang #121 #129
Fiabilitate N/D 10.0
Consistență 9.0 8.4
Teste corecte
Rată de trecere pe încercare 27.8% 25.0%
Teste instabile 2 3
Rulări totale 54 54
Cost per rezultat 0.165 0.000
Cost total $0.007 $0.000
Preț de intrare $0.250 / 1M $0.000 / 1M
Preț de ieșire $0.750 / 1M $0.000 / 1M
Tokenuri de ieșire 1,625 1,567
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 613ms 698ms
Timp de răspuns (maxim) 1.27s 2.21s
Timp de răspuns (total) 11.04s 11.17s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Nemotron 3 Nano Omni 30b A3b Reasoning 5.2 7.9 41.7% 1 580ms 140 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Nemotron 3 Nano Omni 30b A3b Reasoning 10.0 10.0 100.0% 0 1.27s 790 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.8 5.8 33.3% 1 1.42s 252 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.6 7.2 22.2% 1 489ms 35 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.6 9.7 0.0% 0 572ms 79 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Nemotron 3 Nano Omni 30b A3b Reasoning 4.6 10.0 0.0% 0 537ms 75 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.0 10.0 0.0% 0 546ms 196 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0

Comparație rapidă

Schimbă perechea de comparație