#134 Mercury 2.5
high- Coste
- $0.001
- Tiempo
- 3.5s
- Tokens
- 2,447 tok
Resumen
Mercury 2.5 obtiene 7.1 en AI BENCHY y ocupa el puesto #134. Tiene fiabilidad 9.7, una tasa de aciertos de 62.1%, coste total de $0.031 y tiempo medio de respuesta de 4.32s.
Qué hace único a Mercury 2.5: Destaca más en Resolución de acertijos, donde ocupa #2, mientras que Seguimiento de instrucciones es su área más débil con #15. Su coste total de benchmark es inusualmente bajo para su nivel de puntuación.
Investigado el 2026-09-08
Mejor estimación basada en información pública; el proveedor no ha revelado todos los valores.
7.1
Consistencia
8.6
9.7
$0.031
Total de tokens de salida
174,547
Total de tokens de entrada
120,068
Precio de entrada
$0.040 / 1M
Precio de salida
$0.150 / 1M
Pruebas inestables
4
Pruebas inestables tuvieron resultados mixtos entre ejecuciones (al menos un acierto y un fallo).
Tiempo de respuesta (promedio)
4.32s
Tiempo de respuesta (máximo): 23.63s
Tiempo de respuesta (total): 95.06s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Elige el primer modelo y luego haz clic en un segundo modelo para abrir una página lado a lado.
| Categoría | Puntuación | Consistencia | Pruebas correctas |
|---|---|---|---|
| Trucos anti-IA | 10.0 | 10.0 | |
| Programación | 6.4 | 7.8 | |
| Combinado | 6.4 | 5.8 | |
| Análisis y extracción de datos | 10.0 | 10.0 | |
| Específico del dominio | 2.9 | 7.2 | |
| Inteligencia general | 5.0 | 10.0 | |
| Seguimiento de instrucciones | 6.5 | 10.0 | |
| Resolución de acertijos | 8.7 | 7.7 | |
| Llamada de herramientas | 10.0 | 10.0 | |
| Cultura general | 3.0 | 10.0 |