Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Z.ai: GLM 4.7 Flash vs GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-02

Métrica GLM 4.7 Flash GLM 4.7 Flash medium Lanzamiento: 2026-01-19 GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none Lanzamiento: Fecha de lanzamiento desconocida
Puntuación 4.7 3.0
Rango #82 #88
Consistencia 6.6 10.0
Pruebas correctas
Tasa de aciertos por intento 39.2% 0.0%
Pruebas inestables 7 0
Ejecuciones totales 51 48
Costo por resultado 1.046 0.000
Costo total $0.042 $0.000
Precio de entrada $0.060 / 1M $0.000 / 1M
Precio de salida $0.400 / 1M $0.000 / 1M
Tokens de salida 38,719 0
Tokens de razonamiento 65,465 0
Tiempo de respuesta (promedio) 33.44s 0ms
Tiempo de respuesta (máximo) 174.55s 0ms
Tiempo de respuesta (total) 334.39s 0ms

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 1,122 6,110
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 2,585 20,648
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 584 2,755
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 33,000 25,394
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 18 2,138
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 388 2,181
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.90s 798 5,225
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 224 1,014
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0

Comparación rápida

Cambiar par de comparación