Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 Mini vs Qwen3.5-Flash

Qwen3.5-Flash lidera en puntuación media con 6.0 vs 5.9. Qwen3.5-Flash tiene menor coste de benchmark con $0.073 vs $0.095. GPT-5.4 Mini es más rápido con 1.58s vs 25.28s, con tasas de acierto de 31.8% vs 34.9%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-08-26

Rango
#196
Total de tokens de salida
7,898
Tiempo de respuesta (promedio)
1.58s
Costo total
$0.095
Rango
#189
Total de tokens de salida
209,201
Tiempo de respuesta (promedio)
25.28s
Costo total
$0.073
Modelo recomendado GPT-5.4 Mini

Su puntuación se mantiene cerca de la mejor aquí (5.9 vs 6.0) y responde aproximadamente 16.0x más rápido que Qwen3.5-Flash.

Comparación detallada

Métrica GPT-5.4 Mini GPT-5.4 Mini none Lanzamiento: 2026-03-17 Qwen3.5-Flash Qwen3.5-Flash none Lanzamiento: 2026-02-24
Puntuación 5.9 6.0
Rango #196 #189
Fiabilidad 10.0 10.0
Consistencia 9.3 9.3
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 31.8% 34.9%
Pruebas inestables 2 2
Ejecuciones totales 66 66
Costo por resultado 1.581 1.066
Costo total $0.095 $0.073
Precio de entrada $0.750 / 1M $0.065 / 1M
Precio de salida $4.500 / 1M $0.260 / 1M
Total de tokens de entrada 79,076 282,356
Tokens de salida 7,898 209,201
Tokens de razonamiento 0 0
Tiempo de respuesta (promedio) 1.58s 25.28s
Tiempo de respuesta (máximo) 9.92s 480.96s
Tiempo de respuesta (total) 34.86s 556.14s
Parámetros ~400B en total (~17B activos) ~35B en total (~3B activos)
Disponibilidad Código cerrado Código cerrado

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#196 GPT-5.4 Mini

none
Coste
$0.010
Tiempo
11.7s
Tokens
2,151 tok

#189 Qwen3.5-Flash

none
Coste
$0.003
Tiempo
47.4s
Tokens
7,799 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0

Comparación rápida

Cambiar par de comparación