#73 SpaceXAI: Grok 4.7
medium- Coste
- $0.047
- Tiempo
- 132.3s
- Tokens
- 9,954 tok
Resumen
Grok 4.7 obtiene 8.1 en AI BENCHY y ocupa el puesto #73. Tiene fiabilidad 9.9, una tasa de aciertos de 81.8%, coste total de $2.254 y tiempo medio de respuesta de 106.09s.
Qué hace único a Grok 4.7: Destaca más en Resolución de acertijos, donde ocupa #1, mientras que Programación es su área más débil con #15.
Investigado el 2026-09-21
Mejor estimación basada en información pública; el proveedor no ha revelado todos los valores.
8.1
Consistencia
8.3
9.9
$2.254
Total de tokens de salida
433,733
Total de tokens de entrada
107,193
Precio de entrada
$1.600 / 1M
Precio de salida
$4.800 / 1M
Pruebas inestables
5
Pruebas inestables tuvieron resultados mixtos entre ejecuciones (al menos un acierto y un fallo).
Tiempo de respuesta (promedio)
106.09s
Tiempo de respuesta (máximo): 660.89s
Tiempo de respuesta (total): 2333.94s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Elige el primer modelo y luego haz clic en un segundo modelo para abrir una página lado a lado.
| Categoría | Puntuación | Consistencia | Pruebas correctas |
|---|---|---|---|
| Trucos anti-IA | 10.0 | 10.0 | |
| Programación | 6.6 | 4.6 | |
| Combinado | 10.0 | 10.0 | |
| Análisis y extracción de datos | 10.0 | 10.0 | |
| Específico del dominio | 5.3 | 7.2 | |
| Inteligencia general | 5.4 | 2.5 | |
| Seguimiento de instrucciones | 8.4 | 6.9 | |
| Resolución de acertijos | 10.0 | 10.0 | |
| Llamada de herramientas | 10.0 | 10.0 | |
| Cultura general | 3.0 | 10.0 |