AI BENCHY Compare

MiniMax: MiniMax M2.5 vs Qwen: Qwen3.5-122B-A10B

Resumen

Qwen3.5-122B-A10B lidera en puntuación media con 5.3 vs 4.7. Qwen3.5-122B-A10B tiene menor coste de benchmark con $0.020 vs $0.303. Qwen3.5-122B-A10B es más rápido con 3.41s vs 65.37s, con tasas de acierto de 46.0% vs 31.8%.

Modelo recomendadoQwen3.5-122B-A10BTiene la mejor puntuación aquí (5.3) y cuesta aproximadamente 15.6x menos que MiniMax M2.5 (medium).

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-14

Métrica	MiniMax M2.5 MiniMax M2.5 medium Lanzamiento: 2026-02-12	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lanzamiento: 2026-02-24

Métrica	MiniMax M2.5 MiniMax M2.5 medium Lanzamiento: 2026-02-12	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lanzamiento: 2026-02-24
Puntuación	4.7	5.3
Rango	#174	#152
Fiabilidad	10.0	10.0
Consistencia	6.5	9.6
Pruebas correctas
Tasa de aciertos por intento	46.0%	31.8%
Pruebas inestables	9	1
Ejecuciones totales	63	63
Costo por resultado	7.900	0.393
Costo total	$0.303	$0.020
Precio de entrada	$0.150 / 1M	$0.260 / 1M
Precio de salida	$0.900 / 1M	$2.080 / 1M
Total de tokens de entrada	43,706	47,735
Tokens de salida	109,495	3,383
Tokens de razonamiento	330,814	0
Tiempo de respuesta (promedio)	65.37s	3.41s
Tiempo de respuesta (máximo)	251.36s	46.00s
Tiempo de respuesta (total)	849.76s	71.59s

Generación showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#174 MiniMax M2.5

medium

SVG inválido

Coste: $0.000
Tiempo: 300.0s
Tokens: 0 tok

#152 Qwen3.5-122B-A10B

none

Coste: $0.016
Tiempo: 44.5s
Tokens: 6,431 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	7.9	6.3	83.3%	2		20.82s	612	286	45,344
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	3.4	9.1	0.0%	0		188.58s	6,076	357	106,177
Qwen3.5-122B-A10B	3.7	7.0	22.2%	1		2.77s	7,913	693	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	4.5	2.1	66.7%	1		60.39s	21,104	740	9,713
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	4.6	1.7	66.7%	2		7.48s	6,584	266	3,835
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	2.9	4.4	22.2%	2		237.27s	308	105,047	133,487
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	3.8	2.5	33.3%	1		6.63s	492	25	1,686
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	7.5	10.0	50.0%	0		621ms	699	156	1,495
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	5.3	7.2	44.4%	1		11.21s	495	1,069	9,605
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	10.0	10.0	100.0%	0		15.35s	7,123	269	937
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
MiniMax M2.5	3.0	10.0	0.0%	0		80.79s	213	1,280	18,535
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0

Comparación rápida

Cambiar par de comparación

Ling-2.6-1TnonevsMiniMax M2.5medium MiniMax M2.5mediumvsGPT-5.4 Nanonone Mercury 2nonevsMiniMax M2.5medium Ring-2.6-1TnonevsMiniMax M2.5medium MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Ling-2.6-flashnonevsMiniMax M2.5medium MiniMax M2.5mediumvsNemotron 3 SupernoneDisponible gratis MiniMax M2.5mediumvsGLM 4.7 Flashnone Mistral Small 4mediumvsQwen3.5-122B-A10Bnone KAT-Coder-Air V2.5nonevsMiniMax M2.5medium MiniMax M2.5mediumvsGPT-4o-mininone Trinity Large PreviewnonevsMiniMax M2.5medium