AI BENCHY Compare

Qwen: Qwen3.7 Max vs Xiaomi: MiMo-V2-Pro

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-22

Métrica	Qwen3.7 Max Qwen3.7 Max none Lanzamiento: 2026-05-22	MiMo-V2-Pro MiMo-V2-Pro medium Lanzamiento: 2026-03-18

Métrica	Qwen3.7 Max Qwen3.7 Max none Lanzamiento: 2026-05-22	MiMo-V2-Pro MiMo-V2-Pro medium Lanzamiento: 2026-03-18
Puntuación	7.9	7.6
Rango	#26	#44
Fiabilidad	10.0	9.5
Consistencia	10.0	7.9
Pruebas correctas
Tasa de aciertos por intento	70.0%	76.7%
Pruebas inestables	0	5
Ejecuciones totales	60	60
Costo por resultado	0.719	2.453
Costo total	$0.101	$0.295
Precio de entrada	$2.500 / 1M	$1.000 / 1M
Precio de salida	$7.500 / 1M	$3.000 / 1M
Tokens de salida	1,988	2,556
Tokens de razonamiento	0	81,879
Tiempo de respuesta (promedio)	1.30s	22.19s
Tiempo de respuesta (máximo)	3.92s	136.29s
Tiempo de respuesta (total)	25.95s	443.77s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	242	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		2.86s	251	1,154

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	6.8	10.0	50.0%	0		1.39s	576	0
MiMo-V2-Pro	7.5	6.0	83.3%	1		94.21s	527	37,424

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	3.0	10.0	0.0%	0		2.17s	171	0
MiMo-V2-Pro	4.7	1.6	66.7%	1		64.71s	380	14,186

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	243	0
MiMo-V2-Pro	7.3	5.8	83.3%	1		17.20s	260	7,484

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	15	0
MiMo-V2-Pro	5.3	10.0	33.3%	0		8.82s	170	2,158

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	120	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.92s	184	400

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	72	0
MiMo-V2-Pro	9.9	10.0	100.0%	0		3.36s	83	667

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	314	0
MiMo-V2-Pro	6.4	4.4	77.8%	2		5.26s	410	1,700

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	222	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		8.19s	263	864

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	13	0
MiMo-V2-Pro	3.0	10.0	0.0%	0		82.71s	28	15,842

Comparación rápida

Cambiar par de comparación

GPT-5.4mediumvsQwen3.7 Maxnone Qwen3.7 MaxnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2-Promedium Gemini 3.5 FlashminimalvsQwen3.7 Maxnone Gemini 3 Flash PreviewnonevsMiMo-V2-Promedium Gemma 4 31BmediumDisponible gratisvsQwen3.7 Maxnone Qwen3.7 MaxnonevsGrok 4.3medium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Promedium Seed-2.0-LitemediumvsQwen3.7 Maxnone Gemini 3.1 Flash LitelowvsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewmediumvsQwen3.7 Maxnone