#91 Mercury 2.5 Preview
medium- Coste
- $0.001
- Tiempo
- 2.7s
- Tokens
- 2,241 tok
Resumen
Mercury 2.5 Preview obtiene 7.5 en AI BENCHY y ocupa el puesto #91. Tiene fiabilidad 10.0, una tasa de aciertos de 69.7%, coste total de $0.024 y tiempo medio de respuesta de 3.58s.
Qué hace único a Mercury 2.5 Preview: Destaca más en Trucos anti-IA, donde ocupa #1, mientras que Llamada de herramientas es su área más débil con #16. Su coste total de benchmark es inusualmente bajo para su nivel de puntuación. Es notablemente rápido frente a modelos similares.
Investigado el 2026-09-02
Mejor estimación basada en información pública; el proveedor no ha revelado todos los valores.
7.5
Consistencia
9.6
10.0
$0.024
Total de tokens de salida
127,034
Total de tokens de entrada
112,713
Precio de entrada
$0.040 / 1M
Precio de salida
$0.150 / 1M
Pruebas inestables
1
Pruebas inestables tuvieron resultados mixtos entre ejecuciones (al menos un acierto y un fallo).
Tiempo de respuesta (promedio)
3.58s
Tiempo de respuesta (máximo): 17.84s
Tiempo de respuesta (total): 78.66s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Elige el primer modelo y luego haz clic en un segundo modelo para abrir una página lado a lado.
| Categoría | Puntuación | Consistencia | Pruebas correctas |
|---|---|---|---|
| Trucos anti-IA | 10.0 | 10.0 | |
| Programación | 7.8 | 10.0 | |
| Combinado | 6.5 | 10.0 | |
| Análisis y extracción de datos | 10.0 | 10.0 | |
| Específico del dominio | 5.3 | 7.2 | |
| Inteligencia general | 5.0 | 10.0 | |
| Seguimiento de instrucciones | 9.8 | 10.0 | |
| Resolución de acertijos | 10.0 | 10.0 | |
| Llamada de herramientas | 3.0 | 10.0 | |
| Cultura general | 3.0 | 10.0 |