AI BENCHY Compare

Mistral: Mistral Small 4 vs Laguna Xs.2

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-29

Métrica	Mistral Small 4 Mistral Small 4 none Lanzamiento: 2026-03-16	Laguna Xs.2 Laguna Xs.2 none Lanzamiento: 2026-04-28 Disponible gratis

Métrica	Mistral Small 4 Mistral Small 4 none Lanzamiento: 2026-03-16	Laguna Xs.2 Laguna Xs.2 none Lanzamiento: 2026-04-28 Disponible gratis
Puntuación	5.2	5.0
Rango	#109	#118
Fiabilidad	N/D	9.9
Consistencia	9.5	10.0
Pruebas correctas
Tasa de aciertos por intento	31.5%	27.8%
Pruebas inestables	1	0
Ejecuciones totales	54	54
Costo por resultado	0.118	0.000
Costo total	$0.006	$0.000
Precio de entrada	$0.150 / 1M	$0.000 / 1M
Precio de salida	$0.600 / 1M	$0.000 / 1M
Tokens de salida	2,207	3,824
Tokens de razonamiento	0	0
Tiempo de respuesta (promedio)	665ms	1.68s
Tiempo de respuesta (máximo)	1.72s	16.04s
Tiempo de respuesta (total)	11.97s	30.26s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.4	7.9	16.7%	1		395ms	182	0
Laguna Xs.2	3.2	10.0	0.0%	0		743ms	933	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	4.5	9.0	0.0%	0		1.28s	583	0
Laguna Xs.2	2.5	10.0	0.0%	0		1.96s	866	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.0	10.0	0.0%	0		1.72s	496	0
Laguna Xs.2	3.0	10.0	0.0%	0		2.01s	521	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	10.0	10.0	100.0%	0		822ms	261	0
Laguna Xs.2	10.0	10.0	100.0%	0		646ms	246	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	5.3	10.0	33.3%	0		367ms	28	0
Laguna Xs.2	5.3	10.0	33.3%	0		371ms	33	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	4.0	10.0	0.0%	0		729ms	205	0
Laguna Xs.2	5.0	10.0	0.0%	0		16.04s	200	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	6.5	10.0	50.0%	0		380ms	69	0
Laguna Xs.2	6.5	10.0	50.0%	0		439ms	81	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.1	9.9	0.0%	0		589ms	170	0
Laguna Xs.2	5.4	10.0	33.3%	0		688ms	552	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	10.0	10.0	100.0%	0		1.40s	213	0
Laguna Xs.2	3.0	10.0	0.0%	0		1.93s	392	0

Comparación rápida

Cambiar par de comparación

Mistral Small 4nonevsNemotron 3 Nano Omni 30b A3b ReasoningmediumDisponible gratis Mistral Small 4nonevsElephant Alphamedium MiniMax M2.7mediumvsMistral Small 4none Nemotron 3 Nano Omni 30b A3b ReasoningmediumDisponible gratisvsLaguna Xs.2noneDisponible gratis Elephant AlphamediumvsLaguna Xs.2noneDisponible gratis MiniMax M2.7mediumvsLaguna Xs.2noneDisponible gratis Laguna Xs.2noneDisponible gratisvsQwen3 Coder Nextmedium Laguna Xs.2noneDisponible gratisvsGLM 4.7 Flashmedium MiniMax M2.5mediumDisponible gratisvsMistral Small 4none Mistral Small 4nonevsQwen3 Coder Nextmedium Mistral Small 4mediumvsLaguna Xs.2noneDisponible gratis Mistral Small 4nonevsGLM 4.7 Flashmedium