AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5 Nano

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-17

Métrica	Mistral Small 4 Mistral Small 4 none Lanzamiento: 2026-03-16	GPT-5 Nano GPT-5 Nano medium Lanzamiento: 2025-08-07

Métrica	Mistral Small 4 Mistral Small 4 none Lanzamiento: 2026-03-16	GPT-5 Nano GPT-5 Nano medium Lanzamiento: 2025-08-07
Rango	#61	#43
Puntuación	5.3	6.2
Consistencia	9.5	6.7
Costo por resultado	0.108	0.864
Costo total	$0.006	$0.061
Pruebas correctas
Tasa de aciertos por intento	33.3%	58.8%
Pruebas inestables	1	7
Ejecuciones totales	51	51
Tokens de salida	1,624	4,500
Tokens de razonamiento	0	143,296
Tiempo de respuesta (promedio)	629ms	44.47s
Tiempo de respuesta (máximo)	1.72s	204.02s
Tiempo de respuesta (total)	10.70s	444.74s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.4	7.9	16.7%	1		395ms	182	0
GPT-5 Nano	6.5	7.9	58.3%	1		25.50s	1,221	21,184

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.0	10.0	0.0%	0		1.72s	496	0
GPT-5 Nano	10.0	10.0	100.0%	0		65.96s	578	17,984

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	10.0	10.0	100.0%	0		822ms	261	0
GPT-5 Nano	3.7	1.7	50.0%	2		21.42s	453	10,560

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	5.3	10.0	33.3%	0		367ms	28	0
GPT-5 Nano	5.2	4.4	55.6%	2		204.02s	237	64,448

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	4.0	10.0	0.0%	0		729ms	205	0
GPT-5 Nano	4.1	10.0	0.0%	0		17.51s	202	4,608

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	6.5	10.0	50.0%	0		380ms	69	0
GPT-5 Nano	8.5	6.8	83.3%	1		11.90s	382	4,096

Puzzle Solving	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	3.1	9.9	0.0%	0		589ms	170	0
GPT-5 Nano	5.3	7.2	44.4%	1		19.81s	869	13,440

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Mistral Small 4	10.0	10.0	100.0%	0		1.40s	213	0
GPT-5 Nano	10.0	10.0	100.0%	0		33.30s	558	6,976

Comparación rápida

Cambiar par de comparación

DeepSeek V3.2nonevsGPT-5 Nanomedium GPT-5 NanomediumvsQwen3.5-Flashnone Seed-2.0-LitenonevsGPT-5 Nanomedium Gemini 2.5 FlashnonevsGPT-5 Nanomedium GPT-5 NanomediumvsQwen3.5-35B-A3Bnone GPT-5 NanomediumvsHunter Alphanone GPT-5 NanomediumvsQwen3.5-122B-A10Bnone Mistral Small 4nonevsQwen3 Coder Nextmedium GPT-5 NanomediumvsGLM 5none GPT-5 NanomediumvsQwen3.5 Plus 2026-02-15none Mistral Small 4nonevsGLM 4.7 Flashmedium MiniMax M2.5mediumDisponible gratisvsMistral Small 4none