AI BENCHY Compare

Inception: Mercury 2 vs Z.ai: GLM 5

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-03

Métrica	Mercury 2 Mercury 2 medium Lanzamiento: 2026-02-24	GLM 5 GLM 5 none Lanzamiento: 2026-02-12

Métrica	Mercury 2 Mercury 2 medium Lanzamiento: 2026-02-24	GLM 5 GLM 5 none Lanzamiento: 2026-02-12
Puntuación	6.5	6.3
Rango	#89	#96
Fiabilidad	10.0	10.0
Consistencia	8.8	9.7
Pruebas correctas
Tasa de aciertos por intento	51.7%	46.7%
Pruebas inestables	3	1
Ejecuciones totales	60	60
Costo por resultado	0.611	0.246
Costo total	$0.055	$0.025
Precio de entrada	$0.250 / 1M	$0.600 / 1M
Precio de salida	$0.750 / 1M	$1.920 / 1M
Total de tokens de entrada	32,570	34,537
Tokens de salida	4,022	1,985
Tokens de razonamiento	58,405	0
Tiempo de respuesta (promedio)	2.27s	3.95s
Tiempo de respuesta (máximo)	14.63s	11.07s
Tiempo de respuesta (total)	43.20s	51.38s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	6.9	9.9	50.0%	0		1.12s	554	2,546	2,609
GLM 5	4.8	10.0	25.0%	0		2.37s	510	275	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	7.2	6.5	66.7%	1		2.29s	4,519	270	8,514
GLM 5	4.6	6.8	16.7%	1		5.18s	4,658	424	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	10.0	10.0	100.0%	0		3.28s	12,909	268	4,887
GLM 5	3.0	10.0	0.0%	0		4.98s	12,812	406	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	7.3	5.9	83.3%	1		1.11s	6,234	183	1,656
GLM 5	10.0	10.0	100.0%	0		5.78s	7,107	203	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	2.9	7.2	11.1%	1		6.48s	695	41	30,754
GLM 5	3.0	10.0	0.0%	0		2.24s	643	19	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	4.8	10.0	0.0%	0		821ms	456	137	542
GLM 5	10.0	10.0	100.0%	0		3.27s	477	103	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	10.0	10.0	100.0%	0		1.07s	340	14	958
GLM 5	10.0	10.0	100.0%	0		1.48s	636	61	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	5.4	10.0	33.3%	0		949ms	601	361	2,781
GLM 5	7.7	10.0	66.7%	0		1.91s	609	261	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	10.0	10.0	100.0%	0		1.89s	6,080	180	1,956
GLM 5	10.0	10.0	100.0%	0		11.07s	6,899	220	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Mercury 2	3.0	10.0	0.0%	0		2.58s	182	22	3,748
GLM 5	3.0	10.0	0.0%	0		3.62s	186	13	0

Comparación rápida

Cambiar par de comparación

Mercury 2mediumvsGPT-5.5none Gemini 3.1 Flash LitenonevsMercury 2medium Mercury 2mediumvsQwen3.7 Plusnone Mercury 2mediumvsQwen3.5 Plus 2026-02-15none Mercury 2mediumvsRing-2.6-1Tnone Gemini 2.5 FlashnonevsMercury 2medium Gemini 3.1 Flash LiteminimalvsMercury 2medium GPT-5 NanomediumvsGLM 5none Gemma 4 31BnoneDisponible gratisvsMercury 2medium DeepSeek V4 ProhighvsGLM 5none Qwen3.6 27BmediumvsGLM 5none Gemma 4 26B A4BnoneDisponible gratisvsMercury 2medium