Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Nemotron 3 Ultra 550b A55b

Resumen

Comparación benchmark de DeepSeek V4 Pro vs Nemotron 3 Ultra 550b A55b: Nemotron 3 Ultra 550b A55b lidera en puntuación media con 7.5 vs 5.7. DeepSeek V4 Pro tiene menor coste de benchmark con $0.025 vs $0.177. DeepSeek V4 Pro es más rápido con 12.38s vs 15.05s, con tasas de acierto de 42.9% vs 69.8%.

Modelo recomendado: Nemotron 3 Ultra 550b A55b - Tiene la puntuación más alta en esta comparación (7.5) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-04

Métrica DeepSeek V4 Pro DeepSeek V4 Pro none Lanzamiento: 2026-04-24 Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Lanzamiento: 2026-06-04 Disponible gratis
Puntuación 5.7 7.5
Rango #113 #41
Fiabilidad 8.5 9.7
Consistencia 8.5 8.8
Pruebas correctas
Tasa de aciertos por intento 42.9% 69.8%
Pruebas inestables 4 3
Ejecuciones totales 63 63
Costo por resultado 0.660 0.000
Costo total $0.025 $0.177
Precio de entrada $0.435 / 1M $0.500 / 1M
Precio de salida $0.870 / 1M $2.500 / 1M
Total de tokens de entrada 44,845 46,813
Tokens de salida 5,349 18,002
Tokens de razonamiento 0 53,091
Tiempo de respuesta (promedio) 12.38s 15.05s
Tiempo de respuesta (máximo) 58.65s 43.93s
Tiempo de respuesta (total) 260.06s 316.09s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 DeepSeek V4 Pro

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#41 Nemotron 3 Ultra 550b A55b

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 540 704 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 4.6 7.9 22.2% 1 6.11s 7,279 531 0
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 20,773 1,911 0
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 6.9 5.8 66.7% 1 30.54s 5,633 170 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 666 18 0
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 471 132 0
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 627 64 0
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 7.6 7.2 77.8% 1 15.95s 594 173 0
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 8,079 219 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 183 1,427 0
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240

Comparación rápida

Cambiar par de comparación