Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Z.ai: GLM 5V Turbo

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-29

Métrica Seed-2.0-Mini Seed-2.0-Mini medium Lanzamiento: 2026-02-14 GLM 5V Turbo GLM 5V Turbo medium Lanzamiento: 2026-04-01
Puntuación 7.1 7.4
Rango #75 #62
Fiabilidad 10.0 10.0
Consistencia 9.2 8.2
Pruebas correctas
Tasa de aciertos por intento 60.0% 68.3%
Pruebas inestables 2 5
Ejecuciones totales 60 60
Costo por resultado 0.397 3.695
Costo total $0.044 $0.407
Precio de entrada $0.100 / 1M $1.200 / 1M
Precio de salida $0.400 / 1M $4.000 / 1M
Tokens de salida 2,555 2,334
Tokens de razonamiento 95,974 86,653
Tiempo de respuesta (promedio) 80.22s 20.21s
Tiempo de respuesta (máximo) 262.83s 95.88s
Tiempo de respuesta (total) 1363.72s 404.14s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 360 9,520
GLM 5V Turbo 7.2 6.1 75.0% 2 10.76s 587 7,872
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 7.1 9.8 50.0% 0 220.48s 464 34,964
GLM 5V Turbo 6.8 10.0 50.0% 0 54.83s 427 26,111
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 404 29,806
GLM 5V Turbo 6.9 3.8 66.7% 1 15.06s 403 2,523
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 246 2,743
GLM 5V Turbo 10.0 10.0 100.0% 0 9.60s 236 4,333
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0
GLM 5V Turbo 5.3 7.2 44.4% 1 38.15s 32 29,035
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 213 4,210
GLM 5V Turbo 10.0 10.0 100.0% 0 11.09s 131 2,183
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 69 2,050
GLM 5V Turbo 9.9 10.0 100.0% 0 3.74s 72 1,813
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 527 5,667
GLM 5V Turbo 7.7 10.0 66.7% 0 10.24s 131 4,496
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 222 5,235
GLM 5V Turbo 7.0 3.7 66.7% 1 12.53s 293 765
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 50 1,779
GLM 5V Turbo 3.0 10.0 0.0% 0 40.96s 22 7,522

Comparación rápida

Cambiar par de comparación