Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 (medium) vs GPT-5.5 (medium)

GPT-5.5 (medium) lidera en puntuación media con 9.0 vs 8.5. GPT-5.4 (medium) tiene menor coste de benchmark con $1.533 vs $4.137. GPT-5.4 (medium) es más rápido con 23.10s vs 38.42s, con tasas de acierto de 77.3% vs 87.9%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-08-01

Rango
#26
Total de tokens de salida
88,670
Tiempo de respuesta (promedio)
23.10s
Costo total
$1.533
Rango
#16
Total de tokens de salida
124,436
Tiempo de respuesta (promedio)
38.42s
Costo total
$4.137
Modelo recomendado GPT-5.4 (medium)

Su puntuación se mantiene cerca de la mejor aquí (8.5 vs 9.0) y cuesta aproximadamente 2.7x menos que GPT-5.5 (medium).

Comparación detallada

Métrica GPT-5.4 GPT-5.4 medium Lanzamiento: 2026-03-05 GPT-5.5 GPT-5.5 medium Lanzamiento: 2026-04-24
Puntuación 8.5 9.0
Rango #26 #16
Fiabilidad 10.0 10.0
Consistencia 8.6 8.9
Pruebas correctas
Tasa de aciertos por intento 77.3% 87.9%
Pruebas inestables 4 3
Ejecuciones totales 66 66
Costo por resultado 10.220 22.980
Costo total $1.533 $4.137
Precio de entrada $2.500 / 1M $5.000 / 1M
Precio de salida $15.000 / 1M $30.000 / 1M
Total de tokens de entrada 81,127 80,659
Tokens de salida 6,155 5,617
Tokens de razonamiento 82,515 118,819
Tiempo de respuesta (promedio) 23.10s 38.42s
Tiempo de respuesta (máximo) 100.41s 332.10s
Tiempo de respuesta (total) 508.26s 845.35s

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 GPT-5.4

medium
Coste
$0.214
Tiempo
199.6s
Tokens
14,349 tok

#16 GPT-5.5

medium
Coste
$0.112
Tiempo
71.9s
Tokens
3,807 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

Comparación rápida

Cambiar par de comparación