Comparație benchmark Nemotron 3 Ultra 550b A55b vs Mimo V2 Omni: Nemotron 3 Ultra 550b A55b conduce la scorul mediu cu 8.1 vs 5.7. Mimo V2 Omni are costul de benchmark mai mic, $0.021 vs $0.158. Mimo V2 Omni este mai rapid cu 2.44s vs 15.05s, cu rate de reușită de 69.8% vs 39.7%.
Model recomandat: Mimo V2 Omni - Oferă cel mai bun compromis per total: scor competitiv (5.7), cost mai mic decât Nemotron 3 Ultra 550b A55b și timp de răspuns echilibrat.
Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18
Mimo V2 OmniMimo V2 OmninoneModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.Lansare: 2026-03-18
Scor
8.1Scor mediu pe toate testele de benchmark.…
5.7Scor mediu pe toate testele de benchmark.…
Rang
#26
#114
Fiabilitate
9.7Scorul de succes la prima încercare: 10.0 înseamnă fără erori reîncercabile ale API-ului țintă sau de limită de rată înainte de apeluri reușite; erorile urmărite reduc scorul.…
10.0Scorul de succes la prima încercare: 10.0 înseamnă fără erori reîncercabile ale API-ului țintă sau de limită de rată înainte de apeluri reușite; erorile urmărite reduc scorul.…
Consistență
8.8Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
9.7Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
Teste corecte
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 7Eroare API: 1Timp de răspuns (mediu)15.05sTimp de răspuns (maxim)43.93sTimp de răspuns (total)316.09sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)8.62sTimp de răspuns (maxim)16.86sTimp de răspuns (total)34.49sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
8.62sTimp de răspuns (mediu)…
780Total tokenuri de intrare…
835Tokenuri de ieșire…
1,485Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
3.6Scor mediu pe toate testele de benchmark.…
8.4Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
8.3%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 3Nu a urmat instrucțiunile: 1Timp de răspuns (mediu)1.63sTimp de răspuns (maxim)3.29sTimp de răspuns (total)6.52sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
7.4Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
88.9%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
1Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)26.53sTimp de răspuns (maxim)31.91sTimp de răspuns (total)79.58sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
26.53sTimp de răspuns (mediu)…
7,686Total tokenuri de intrare…
2,854Tokenuri de ieșire…
17,725Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
4.4Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 1Formatare suplimentară: 1Răspuns greșit: 1Timp de răspuns (mediu)2.75sTimp de răspuns (maxim)3.79sTimp de răspuns (total)5.50sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)43.93sTimp de răspuns (maxim)43.93sTimp de răspuns (total)43.93sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
43.93sTimp de răspuns (mediu)…
17,574Total tokenuri de intrare…
1,040Tokenuri de ieșire…
3,590Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
3.0Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)5.96sTimp de răspuns (maxim)5.96sTimp de răspuns (total)5.96sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)5.68sTimp de răspuns (maxim)7.94sTimp de răspuns (total)11.36sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
5.68sTimp de răspuns (mediu)…
7,989Total tokenuri de intrare…
473Tokenuri de ieșire…
1,285Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
10.0Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)1.76sTimp de răspuns (maxim)2.60sTimp de răspuns (total)3.51sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
4.4Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
33.3%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
2Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 3Timp de răspuns (mediu)24.90sTimp de răspuns (maxim)34.96sTimp de răspuns (total)74.71sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
24.90sTimp de răspuns (mediu)…
858Total tokenuri de intrare…
11,169Tokenuri de ieșire…
16,249Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
5.3Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
33.3%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 2Timp de răspuns (mediu)2.10sTimp de răspuns (maxim)3.58sTimp de răspuns (total)6.30sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
9.5Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Eroare API: 1Timp de răspuns (mediu)2.52sTimp de răspuns (maxim)2.52sTimp de răspuns (total)2.52sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
2.52sTimp de răspuns (mediu)…
360Total tokenuri de intrare…
70Tokenuri de ieșire…
235Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
4.1Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)2.33sTimp de răspuns (maxim)2.33sTimp de răspuns (total)2.33sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)6.35sTimp de răspuns (maxim)9.38sTimp de răspuns (total)12.69sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
6.35sTimp de răspuns (mediu)…
765Total tokenuri de intrare…
182Tokenuri de ieșire…
1,243Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
6.5Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
50.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)4.26sTimp de răspuns (maxim)6.81sTimp de răspuns (total)8.51sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
9.9Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
33.3%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 2Timp de răspuns (mediu)3.54sTimp de răspuns (maxim)6.03sTimp de răspuns (total)10.62sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
3.54sTimp de răspuns (mediu)…
792Total tokenuri de intrare…
771Tokenuri de ieșire…
2,055Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
10.0Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)1.16sTimp de răspuns (maxim)1.55sTimp de răspuns (total)3.48sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)7.72sTimp de răspuns (maxim)7.72sTimp de răspuns (total)7.72sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
7.72sTimp de răspuns (mediu)…
9,781Total tokenuri de intrare…
304Tokenuri de ieșire…
984Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
10.0Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
100.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Niciun răspuns eșuat.Timp de răspuns (mediu)5.40sTimp de răspuns (maxim)5.40sTimp de răspuns (total)5.40sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)38.47sTimp de răspuns (maxim)38.47sTimp de răspuns (total)38.47sUn test este considerat trecut complet doar dacă toate rulările lui trec.…
38.47sTimp de răspuns (mediu)…
228Total tokenuri de intrare…
304Tokenuri de ieșire…
8,240Tokenuri de raționament…
Mimo V2 OmniModel arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
3.0Scor mediu pe toate testele de benchmark.…
10.0Scorul de consistență reflectă stabilitatea între rulări (10 = foarte consistent, chiar dacă este constant greșit).…
0.0%Rata de trecere pe încercare = încercări trecute / total încercări pe toate rulările.…
0Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).…
Un test este considerat trecut complet doar dacă toate rulările lui trec.Răspuns greșit: 1Timp de răspuns (mediu)1.30sTimp de răspuns (maxim)1.30sTimp de răspuns (total)1.30sUn test este considerat trecut complet doar dacă toate rulările lui trec.…