Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs NVIDIA: Nemotron 3 Super

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică Kimi K2.5 Kimi K2.5 none Lansare: 2026-01-27 Nemotron 3 Super Nemotron 3 Super medium Lansare: 2026-03-11 Disponibil gratuit
Scor 5.3 5.9
Rang #126 #96
Fiabilitate 10.0 10.0
Consistență 8.9 8.8
Teste corecte
Rată de trecere pe încercare 36.7% 45.0%
Teste instabile 3 3
Rulări totale 60 60
Cost per rezultat 0.428 0.004
Cost total $0.026 $0.001
Preț de intrare $0.400 / 1M $0.090 / 1M
Preț de ieșire $1.900 / 1M $0.450 / 1M
Tokenuri de ieșire 6,734 14,550
Tokenuri de raționament 0 30,428
Timp de răspuns (mediu) 14.16s 21.15s
Timp de răspuns (maxim) 42.13s 87.80s
Timp de răspuns (total) 184.10s 380.67s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 373 0
Nemotron 3 Super 8.3 10.0 75.0% 0 7.85s 748 1,305
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 6.8 10.0 50.0% 0 35.97s 4,704 0
Nemotron 3 Super 3.1 9.9 0.0% 0 62.38s 452 848
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 748 0
Nemotron 3 Super 10.0 10.0 100.0% 0 87.80s 2,021 9,996
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 187 0
Nemotron 3 Super 10.0 10.0 100.0% 0 18.16s 877 2,607
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 29 0
Nemotron 3 Super 2.9 4.4 22.2% 2 16.19s 5,255 6,072
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 76 0
Nemotron 3 Super 4.1 10.0 0.0% 0 6.91s 105 363
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 60 0
Nemotron 3 Super 7.2 6.6 66.7% 1 7.72s 1,042 2,479
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 3.0 10.0 0.0% 0 4.73s 317 0
Nemotron 3 Super 3.1 10.0 0.0% 0 4.32s 529 1,476
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 220 0
Nemotron 3 Super 10.0 10.0 100.0% 0 39.75s 270 1,969
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 20 0
Nemotron 3 Super 3.0 10.0 0.0% 0 55.32s 3,251 3,313

Comparație rapidă

Schimbă perechea de comparație