Navegación
AI BENCHY
Comparar Gráficos
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs MiniMax: MiniMax M2.5

Comparar:

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-05

Métrica Inception: Mercury 2 none Lanzamiento: 2026-02-24 MiniMax: MiniMax M2.5 medium Lanzamiento: 2026-02-12
Rango #50 #42
Puntaje prom. 34 48
Consistencia 89 58
Costo por resultado 0.147 4.937
Costo total $0.006 $0.247
Tiempo de respuesta (promedio) 594ms 47.58s
Tiempo de respuesta (máximo) 1.27s 237.27s
Tiempo de respuesta (total) 8.91s 380.62s
Pruebas correctas
Tasa de aciertos por intento 33.3% 62.2%
Pruebas inestables 2 8
Tokens de salida 1,144 107,019
Tokens de razonamiento 0 204,504

Mejores modelos por puntuación

Tiempo de respuesta (promedio)

Puntuación vs costo total

Puntaje prom. vs Tiempo de respuesta (promedio)

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 100 100 0.0% 0 466ms 274 0
MiniMax: MiniMax M2.5 93 79 88.9% 1 32.42s 286 45,112
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 100 100 0.0% 0 606ms 131 0
MiniMax: MiniMax M2.5 100 21 66.7% 1 60.39s 740 9,713
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 55 59 83.3% 1 667ms 180 0
MiniMax: MiniMax M2.5 100 17 66.7% 2 7.48s 266 3,835
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 40 72 44.4% 1 534ms 46 0
MiniMax: MiniMax M2.5 100 44 22.2% 2 237.27s 105,047 133,487
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 55 100 50.0% 0 551ms 82 0
MiniMax: MiniMax M2.5 80 68 83.3% 1 4.64s 252 1,873
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 100 100 0.0% 0 533ms 234 0
MiniMax: MiniMax M2.5 40 72 44.4% 1 11.54s 159 9,547
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Inception: Mercury 2 100 100 100.0% 0 1.27s 197 0
MiniMax: MiniMax M2.5 100 100 100.0% 0 15.35s 269 937

Comparación rápida

Cambiar par de comparación