Navegación
Advertise here

Claude Sonnet 5.5 (low) vs Kimi K2.6 (medium)

La puntuación media está prácticamente empatada en 6.9 vs 6.8. Claude Sonnet 5.5 (low) tiene menor coste de benchmark con $0.909 vs $1.323. Claude Sonnet 5.5 (low) es más rápido con 7.46s vs 121.25s, con tasas de acierto de 46.4% vs 60.9%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-01

Modelos comparados

Rango
#166
Total de tokens de salida
32,443
Tiempo de respuesta (promedio)
7.46s
Costo total
$0.909
Rango
#168
Total de tokens de salida
396,671
Tiempo de respuesta (promedio)
121.25s
Costo total
$1.323
Modelo recomendado Claude Sonnet 5.5 (low)

Tiene la mejor puntuación aquí (6.9) y responde aproximadamente 16.3x más rápido que Kimi K2.6 (medium).

Comparación detallada

Métrica Claude Sonnet 5.5 Claude Sonnet 5.5 low Lanzamiento: 2026-09-29 Kimi K2.6 Kimi K2.6 medium Lanzamiento: 2026-04-20
Puntuación 6.9 6.8
Rango #166 #168
Fiabilidad 10.0 10.0
Consistencia 9.4 8.4
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 46.4% 60.9%
Pruebas inestables 2 4
Ejecuciones totales 69 69
Costo por resultado 9.082 12.282
Costo total $0.909 $1.323
Precio de entrada $2.000 / 1M $0.650 / 1M
Precio de salida $10.000 / 1M $3.410 / 1M
Total de tokens de entrada 291,853 226,880
Tokens de salida 24,116 65,346
Tokens de razonamiento 8,327 331,325
Tiempo de respuesta (promedio) 7.46s 121.25s
Tiempo de respuesta (máximo) 46.61s 876.20s
Tiempo de respuesta (total) 171.47s 2667.55s
Parámetros ~1T en total (~100B activos) 1T en total (32B activos)
Disponibilidad Código cerrado Pesos disponibles

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Claude Sonnet 5.5

low
Coste
$0.020
Tiempo
15.3s
Tokens
2,077 tok

#168 MoonshotAI: Kimi K2.6

medium
Coste
$0.013
Tiempo
103.4s
Tokens
3,620 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189

Comparación rápida

Cambiar par de comparación