Navegación
AI BENCHY
Advertise here

Seed-2.0-Code vs Kimi K2.5

Kimi K2.5 lidera en puntuación media con 5.4 vs 5.3. Kimi K2.5 tiene menor coste de benchmark con $0.101 vs $0.151. Seed-2.0-Code es más rápido con 14.67s vs 18.03s, con tasas de acierto de 36.4% vs 30.3%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-08-20

Rango
#228
Total de tokens de salida
23,433
Tiempo de respuesta (promedio)
14.67s
Costo total
$0.151
Rango
#223
Total de tokens de salida
26,643
Tiempo de respuesta (promedio)
18.03s
Costo total
$0.101
Modelo recomendado Kimi K2.5

Tiene la puntuación más alta en esta comparación (5.4) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Comparación detallada

Métrica Seed-2.0-Code Seed-2.0-Code none Lanzamiento: 2026-08-12 Kimi K2.5 Kimi K2.5 none Lanzamiento: 2026-01-27
Puntuación 5.3 5.4
Rango #228 #223
Fiabilidad 8.6 10.0
Consistencia 8.1 8.6
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 36.4% 30.3%
Pruebas inestables 5 4
Ejecuciones totales 66 66
Costo por resultado 2.503 2.278
Costo total $0.151 $0.101
Precio de entrada $0.500 / 1M $0.450 / 1M
Precio de salida $3.000 / 1M $2.250 / 1M
Total de tokens de entrada 159,749 89,320
Tokens de salida 23,433 26,643
Tokens de razonamiento 0 0
Tiempo de respuesta (promedio) 14.67s 18.03s
Tiempo de respuesta (máximo) 132.84s 102.83s
Tiempo de respuesta (total) 322.71s 288.42s
Parámetros ~200B en total (~20B activos) 1T en total (32B activos)
Disponibilidad Código cerrado Pesos disponibles

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#228 Seed-2.0-Code

none
Coste
$0.030
Tiempo
140.6s
Tokens
9,924 tok

#223 MoonshotAI: Kimi K2.5

none
Coste
$0.015
Tiempo
89.1s
Tokens
5,421 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Seed-2.0-Code 3.6 9.8 0.0% 0 13.42s 7,230 505 0
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0

Comparación rápida

Cambiar par de comparación