Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M2.5 vs OpenAI: GPT-5.4

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-03

Métrica MiniMax M2.5 MiniMax M2.5 medium Lanzamiento: 2026-02-12 GPT-5.4 GPT-5.4 none Lanzamiento: 2026-03-05
Puntuación 5.5 5.6
Rango #125 #121
Fiabilidad 10.0 10.0
Consistencia 6.4 9.1
Pruebas correctas
Tasa de aciertos por intento 48.3% 38.3%
Pruebas inestables 9 2
Ejecuciones totales 60 60
Costo por resultado 6.075 1.644
Costo total $0.294 $0.116
Precio de entrada $0.150 / 1M $2.500 / 1M
Precio de salida $1.150 / 1M $15.000 / 1M
Total de tokens de entrada 41,948 31,593
Tokens de salida 109,492 2,402
Tokens de razonamiento 251,674 0
Tiempo de respuesta (promedio) 49.87s 1.45s
Tiempo de respuesta (máximo) 237.27s 2.95s
Tiempo de respuesta (total) 598.39s 29.00s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 3.5 9.8 0.0% 0 125.80s 4,318 354 27,037
GPT-5.4 6.8 10.0 50.0% 0 1.99s 4,686 501 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0

Comparación rápida

Cambiar par de comparación