Navegación
Advertise here

DeepSeek V3.2 vs KAT Coder AIR V2.5 (default)

DeepSeek V3.2 lidera en puntuación media con 4.6 vs 4.4. KAT Coder AIR V2.5 (default) tiene menor coste de benchmark con $0.070 vs $0.119. KAT Coder AIR V2.5 (default) es más rápido con 11.96s vs 22.44s, con tasas de acierto de 34.8% vs 34.8%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-07

Modelos comparados

Rango
#334
Total de tokens de salida
57,866
Tiempo de respuesta (promedio)
22.44s
Costo total
$0.119
Rango
#348
Total de tokens de salida
97,752
Tiempo de respuesta (promedio)
11.96s
Costo total
$0.070
Modelo recomendado KAT Coder AIR V2.5 (default)

Su puntuación se mantiene cerca de la mejor aquí (4.4 vs 4.6) y cuesta aproximadamente 1.7x menos que DeepSeek V3.2.

Comparación detallada

Métrica DeepSeek V3.2 DeepSeek V3.2 none Lanzamiento: 2025-12-01 KAT Coder AIR V2.5 KAT Coder AIR V2.5 default Lanzamiento: 2026-07-14
Puntuación 4.6 4.4
Rango #334 #348
Fiabilidad 10.0 10.0
Consistencia 8.2 7.4
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 34.8% 34.8%
Pruebas inestables 5 7
Ejecuciones totales 69 69
Costo por resultado 1.943 1.382
Costo total $0.119 $0.070
Precio de entrada $0.280 / 1M $0.150 / 1M
Precio de salida $0.420 / 1M $0.600 / 1M
Precio de lectura de caché $0.028 / 1M N/D
Precio de escritura de caché N/D N/D
Total de tokens de entrada 342,158 69,376
Tokens de salida 32,853 7,792
Tokens de razonamiento 25,013 89,960
Tiempo de respuesta (promedio) 22.44s 11.96s
Tiempo de respuesta (máximo) 122.50s 121.05s
Tiempo de respuesta (total) 516.03s 275.18s
Parámetros 671B en total (37B activos) ~35B en total (~3B activos)
Disponibilidad Código abierto Código cerrado

Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#334 DeepSeek V3.2

none
Coste
$0.002
Tiempo
7.0s
Tokens
1,046 tok

#348 KAT Coder AIR V2.5

default
Coste
$0.002
Tiempo
14.5s
Tokens
2,619 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
KAT Coder AIR V2.5 3.3 9.6 0.0% 0 14.31s 6,472 2,032 14,886

Comparación rápida

Cambiar par de comparación