Mistral: Mistral Small 4 vs Xiaomi: MiMo-V2.5

La puntuación media está prácticamente empatada en 5.1 vs 5.1. MiMo-V2.5 tiene menor coste de benchmark con $0.025 vs $0.096. MiMo-V2.5 es más rápido con 4.62s vs 10.77s, con tasas de acierto de 42.4% vs 25.8%.

Modelo recomendadoMiMo-V2.5Tiene la mejor puntuación aquí (5.1) y cuesta aproximadamente 3.9x menos que Mistral Small 4 (medium).

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-21

Métrica	Mistral Small 4 Mistral Small 4 medium Lanzamiento: 2026-03-16	MiMo-V2.5 MiMo-V2.5 none Lanzamiento: 2026-04-22

Métrica	Mistral Small 4 Mistral Small 4 medium Lanzamiento: 2026-03-16	MiMo-V2.5 MiMo-V2.5 none Lanzamiento: 2026-04-22
Puntuación	5.1	5.1
Rango	#173	#174
Fiabilidad	10.0	10.0
Consistencia	7.0	9.6
Pruebas correctas
Tasa de aciertos por intento	42.4%	25.8%
Pruebas inestables	8	1
Ejecuciones totales	66	66
Costo por resultado	1.913	0.770
Costo total	$0.096	$0.025
Precio de entrada	$0.150 / 1M	$0.140 / 1M
Precio de salida	$0.600 / 1M	$0.280 / 1M
Total de tokens de entrada	140,494	141,043
Tokens de salida	39,462	16,464
Tokens de razonamiento	92,362	0
Tiempo de respuesta (promedio)	10.77s	4.62s
Tiempo de respuesta (máximo)	59.15s	55.36s
Tiempo de respuesta (total)	236.94s	101.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 Mistral Small 4

medium

Coste: $0.006
Tiempo: 47.9s
Tokens: 9,857 tok

#174 MiMo-V2.5

none

Coste: $0.007
Tiempo: 267.4s
Tokens: 25,283 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	708	4,055	4,778
MiMo-V2.5	3.5	8.0	16.7%	1		2.19s	645	282	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	4.4	5.1	33.3%	2		39.98s	7,636	11,635	54,715
MiMo-V2.5	5.5	10.0	33.3%	0		3.24s	7,440	696	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.0	10.0	0.0%	0		32.40s	116,624	17,890	18,384
MiMo-V2.5	3.0	10.0	0.0%	0		28.86s	114,133	14,527	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	6,171	335	723
MiMo-V2.5	6.5	10.0	50.0%	0		1.01s	7,758	366	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	742	2,621	6,904
MiMo-V2.5	3.0	10.0	0.0%	0		756ms	753	27	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	519	821	828
MiMo-V2.5	4.4	9.9	0.0%	0		6.86s	498	81	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	729	540	1,031
MiMo-V2.5	6.5	10.0	50.0%	0		751ms	684	72	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.4	9.7	0.0%	0		2.17s	735	1,226	2,632
MiMo-V2.5	5.4	10.0	33.3%	0		2.13s	678	166	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	6,420	321	810
MiMo-V2.5	10.0	10.0	100.0%	0		2.43s	8,238	231	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.0	10.0	0.0%	0		5.92s	210	18	1,557
MiMo-V2.5	3.0	10.0	0.0%	0		3.89s	216	16	0

Comparación rápida

Cambiar par de comparación