Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs HY3 Preview

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-24

Métrica GPT-5.3-Codex GPT-5.3-Codex medium Lanzamiento: 2026-02-05 HY3 Preview HY3 Preview low Lanzamiento: 2026-04-22 Disponible gratis
Puntuación 8.6 8.1
Rango #8 #24
Fiabilidad N/D N/D
Consistencia 8.7 9.5
Pruebas correctas
Tasa de aciertos por intento 83.3% 75.9%
Pruebas inestables 3 1
Ejecuciones totales 54 50
Costo por resultado 4.405 0.000
Costo total $0.573 $0.000
Precio de entrada $1.750 / 1M $0.000 / 1M
Precio de salida $14.000 / 1M $0.000 / 1M
Tokens de salida 2,279 65,778
Tokens de razonamiento 35,179 0
Tiempo de respuesta (promedio) 15.38s 23.98s
Tiempo de respuesta (máximo) 100.93s 78.74s
Tiempo de respuesta (total) 276.91s 407.72s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
HY3 Preview 10.0 10.0 100.0% 0 16.61s 7,905 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 8.95s 491 1,530
HY3 Preview 10.0 10.0 100.0% 0 27.94s 7,907 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
HY3 Preview 10.0 10.0 100.0% 0 78.74s 12,975 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
HY3 Preview 6.5 10.0 50.0% 0 5.85s 1,022 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
HY3 Preview 5.9 7.2 55.6% 1 40.44s 23,121 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
HY3 Preview 10.0 10.0 100.0% 0 16.44s 2,185 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
HY3 Preview 10.0 10.0 100.0% 0 15.98s 2,475 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
HY3 Preview 5.3 10.0 33.3% 0 13.73s 6,985 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
HY3 Preview 10.0 10.0 100.0% 0 17.84s 1,203 0

Comparación rápida

Cambiar par de comparación