#268 GLM 5
none- Coste
- $0.007
- Tiempo
- 32.1s
- Tokens
- 2,023 tok
Resumen
GLM 5 obtiene 5.6 en AI BENCHY y ocupa el puesto #268. Tiene fiabilidad 10.0, una tasa de aciertos de 40.6%, coste total de $0.140 y tiempo medio de respuesta de 8.74s.
Qué hace único a GLM 5: Destaca más en Inteligencia general, donde ocupa #1, mientras que Combinado es su área más débil con #16.
Investigado el 2026-08-12
5.6
Consistencia
9.3
10.0
Total de tokens de salida
5,577
Total de tokens de entrada
190,675
Precio de entrada
$0.600 / 1M
Precio de salida
$1.920 / 1M
Precio de lectura de caché
$0.120 / 1M
Precio de escritura de caché
N/D
Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.
Pruebas incorrectas: 13
Tasa de aciertos por intento: 40.6%
Cobertura del benchmark: 66/69 intentos (Objetivo: 3 repeticiones por prueba)
Pruebas inestables
1
Pruebas inestables tuvieron resultados mixtos entre ejecuciones (al menos un acierto y un fallo).
Tiempo de respuesta (promedio)
8.74s
Tiempo de respuesta (máximo): 74.80s
Tiempo de respuesta (total): 131.17s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Historial de ejecuciones
| Probado el | Puntuación | Fiabilidad | Pruebas correctas | Costo total | Comparar |
|---|---|---|---|---|---|
| 2026-10-01 05:14 Nueva prueba | 5.6 | 10.0 | $0.140 ↑ | Ejecución actual | |
| 2026-06-04 13:05 Nueva prueba | 5.7 | 10.0 | $0.042 ↑ | Comparar | |
| 2026-06-04 13:05 Prueba nueva añadida | 6.1 | 10.0 | $0.027 ↑ | Comparar | |
| 2026-05-21 23:41 Suite modificada | 6.3 | 10.0 | $0.023 | Comparar | |
| 2026-04-22 12:55 Primera ejecución registrada | 6.6 | N/D | $0.020 | Comparar |
Comparación de ejecuciones
| Ejecución | Cobertura del benchmark | Puntuación | Consistencia | Fiabilidad | Pruebas correctas | Pruebas inestables | Total de tokens de salida | Total de tokens de entrada | Costo total | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 05:14 · Ejecución actual | 66/69 intentos | 5.6 | 9.3 | 10.0 | 9/22 | 1 | 5,577 | 190,675 | $0.140 | 8.74s |
| 2026-06-04 13:05 · Prueba nueva añadida | 63/63 intentos | 6.1 | 9.7 | 10.0 | 9/21 | 1 | 1,989 | 37,135 | $0.027 | 4.03s |
| Diferencia | — | -0.5 | -0.4 | 0.0 | 0 | 0 | +3588 | +153540 | +$0.114 | +4718ms |
La cobertura del benchmark difiere: 66/69 intentos (Objetivo: 3 repeticiones por prueba) frente a 63/63 intentos (Objetivo: 3 repeticiones por prueba). Los totales y las métricas sensibles a las repeticiones no son directamente comparables.
Historial de precios
Datos históricos de precios de este modelo de OpenRouter.
| Fecha | Precio de entrada | Precio de salida | Precio de lectura de caché | Precio de escritura de caché |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.600 / 1M | $1.920 / 1M | N/D | N/D |
| 2026-07-16 15:36 | $0.950 / 1M | $3.150 / 1M | N/D | N/D |
| 2026-07-20 15:56 | $0.950 / 1M | $2.551 / 1M | N/D | N/D |
| 2026-10-01 18:33 | $0.600 / 1M | $1.920 / 1M | $0.120 / 1M | N/D |
Elige el primer modelo y luego haz clic en un segundo modelo para abrir una página lado a lado.
| Categoría | Puntuación | Consistencia | Pruebas correctas |
|---|---|---|---|
| Tareas de agentes | 5.0 | 10.0 | |
| Trucos anti-IA | 4.8 | 10.0 | |
| Programación | 4.0 | 7.8 | |
| Combinado | 1.5 | 5.0 | |
| Análisis y extracción de datos | 10.0 | 10.0 | |
| Específico del dominio | 3.0 | 10.0 | |
| Inteligencia general | 10.0 | 10.0 | |
| Seguimiento de instrucciones | 10.0 | 10.0 | |
| Resolución de acertijos | 7.7 | 10.0 | |
| Llamada de herramientas | 10.0 | 10.0 | |
| Cultura general | 3.0 | 10.0 |