Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs DeepSeek: DeepSeek V4 Pro

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-25

Métrica DeepSeek V3.2 DeepSeek V3.2 none Lanzamiento: 2025-12-01 DeepSeek V4 Pro DeepSeek V4 Pro none Lanzamiento: 2026-04-24
Puntuación 6.0 6.7
Rango #74 #61
Fiabilidad N/D 0.0
Consistencia 8.6 9.5
Pruebas correctas
Tasa de aciertos por intento 46.3% 51.9%
Pruebas inestables 3 1
Ejecuciones totales 52 26
Costo por resultado 0.225 0.327
Costo total $0.016 $0.030
Precio de entrada $0.252 / 1M $1.740 / 1M
Precio de salida $0.378 / 1M $3.480 / 1M
Tokens de salida 8,378 1,611
Tokens de razonamiento 0 0
Tiempo de respuesta (promedio) 12.07s 23.34s
Tiempo de respuesta (máximo) 115.89s 109.46s
Tiempo de respuesta (total) 217.28s 420.04s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 3.2 9.8 0.0% 0 7.63s 1,419 0
DeepSeek V4 Pro 4.8 10.0 25.0% 0 36.12s 221 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 2.4 1.3 33.3% 1 7.63s 553 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 33.40s 246 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 2,887 0
DeepSeek V4 Pro 9.5 10.0 100.0% 0 34.55s 826 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 1,710 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 54.04s 65 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 3.0 10.0 0.0% 0 1.52s 18 0
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.08s 12 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 10.0 10.0 100.0% 0 2.86s 67 0
DeepSeek V4 Pro 4.5 10.0 0.0% 0 6.06s 45 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 66 0
DeepSeek V4 Pro 6.5 10.0 50.0% 0 9.47s 25 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 8.5 7.5 88.9% 1 7.37s 1,136 0
DeepSeek V4 Pro 6.0 7.1 44.4% 1 19.60s 98 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 522 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 6.47s 73 0

Comparación rápida

Cambiar par de comparación