Resumen
Claude Opus 5.5 obtiene 1.8 en AI BENCHY y ocupa el puesto #359. Tiene fiabilidad 10.0, una tasa de aciertos de 4.6%, coste total de $0.015 y tiempo medio de respuesta de 13.58s.
Qué hace único a Claude Opus 5.5: Su coste total de benchmark es inusualmente bajo para su nivel de puntuación.
Modelo archivado: este modelo ya no se actualiza ni se prueba en pruebas nuevas.
Datos del modelo
Investigado el 2026-09-23
- Parámetros
- ~5T en total (~500B activos)
- Arquitectura
- MoE
- Disponibilidad
- Código cerrado
- Licencia
- -
Mejor estimación basada en información pública; el proveedor no ha revelado todos los valores.
1.8
Consistencia
5.0
10.0
$0.015
Total de tokens de salida
735
Total de tokens de entrada
73
Precio de entrada
$4.000 / 1M
Precio de salida
$20.000 / 1M
Pruebas inestables
0
Pruebas inestables tuvieron resultados mixtos entre ejecuciones (al menos un acierto y un fallo).
Tiempo de respuesta (promedio)
13.58s
Tiempo de respuesta (máximo): 13.58s
Tiempo de respuesta (total): 13.58s
Gráficos
Elige el primer modelo y luego haz clic en un segundo modelo para abrir una página lado a lado.
Puntuación vs Costo total
Tiempo de respuesta (promedio)
Puntuación vs Tiempo de respuesta (promedio)
Total de tokens de salida
Puntuación vs Total de tokens de salida
Desglose por categoría
| Categoría | Puntuación | Consistencia | Pruebas correctas |
|---|---|---|---|
| Trucos anti-IA | 0.0 | 0.0 | |
| Programación | 0.0 | 0.0 | |
| Combinado | 0.0 | 0.0 | |
| Análisis y extracción de datos | 0.0 | 0.0 | |
| Específico del dominio | 3.3 | 3.3 | |
| Inteligencia general | 0.0 | 0.0 | |
| Seguimiento de instrucciones | 0.0 | 0.0 | |
| Resolución de acertijos | 0.0 | 0.0 | |
| Llamada de herramientas | 0.0 | 0.0 | |
| Cultura general | 0.0 | 0.0 |