Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs OpenAI: GPT-5 Nano

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-24

Métrica DeepSeek V4 Flash DeepSeek V4 Flash none Lanzamiento: 2026-04-24 GPT-5 Nano GPT-5 Nano medium Lanzamiento: 2025-08-07
Puntuación 5.3 6.3
Rango #89 #65
Consistencia 9.1 6.5
Pruebas correctas
Tasa de aciertos por intento 33.3% 59.3%
Pruebas inestables 2 8
Ejecuciones totales 54 54
Costo por resultado 0.147 0.942
Costo total $0.008 $0.066
Precio de entrada $0.140 / 1M $0.050 / 1M
Precio de salida $0.280 / 1M $0.400 / 1M
Tokens de salida 4,444 4,980
Tokens de razonamiento 0 156,288
Tiempo de respuesta (promedio) 29.39s 44.13s
Tiempo de respuesta (máximo) 111.96s 204.02s
Tiempo de respuesta (total) 529.10s 485.47s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 3.0 10.0 0.0% 0 20.18s 174 0
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 6.3 10.0 0.0% 0 24.04s 471 0
GPT-5 Nano 6.7 3.5 66.7% 1 40.73s 480 12,992
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 4.5 2.1 66.7% 1 111.96s 2,664 0
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 10.0 10.0 100.0% 0 23.79s 195 0
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 5.3 10.0 33.3% 0 19.73s 18 0
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 4.2 9.9 0.0% 0 23.74s 67 0
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 6.5 10.0 50.0% 0 17.54s 321 0
GPT-5 Nano 8.5 6.8 83.3% 1 11.90s 382 4,096
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 3.1 7.3 11.1% 1 22.96s 207 0
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
DeepSeek V4 Flash 10.0 10.0 100.0% 0 77.93s 327 0
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976

Comparación rápida

Cambiar par de comparación