Navegación
AI BENCHY
Advertise here

Claude Fable 5.1 (low) vs DeepSeek V3.2 (medium)

DeepSeek V3.2 (medium) lidera en puntuación media con 7.0 vs 6.9. DeepSeek V3.2 (medium) tiene menor coste de benchmark con $0.078 vs $2.565. Claude Fable 5.1 (low) es más rápido con 10.33s vs 68.43s, con tasas de acierto de 56.1% vs 65.2%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-02

Rango
#136
Total de tokens de salida
24,375
Tiempo de respuesta (promedio)
10.33s
Costo total
$2.565
Rango
#128
Total de tokens de salida
128,787
Tiempo de respuesta (promedio)
68.43s
Costo total
$0.078
Modelo recomendado DeepSeek V3.2 (medium)

Tiene la mejor puntuación aquí (7.0) y cuesta aproximadamente 33.3x menos que Claude Fable 5.1 (low).

Comparación detallada

Métrica Claude Fable 5.1 Claude Fable 5.1 low Lanzamiento: 2026-09-02 DeepSeek V3.2 DeepSeek V3.2 medium Lanzamiento: 2025-12-01
Puntuación 6.9 7.0
Rango #136 #128
Fiabilidad 10.0 10.0
Consistencia 9.2 7.4
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 56.1% 65.2%
Pruebas inestables 2 7
Ejecuciones totales 66 66
Costo por resultado 23.315 0.672
Costo total $2.565 $0.078
Precio de entrada $10.000 / 1M $0.269 / 1M
Precio de salida $50.000 / 1M $0.400 / 1M
Total de tokens de entrada 134,582 101,056
Tokens de salida 8,955 11,832
Tokens de razonamiento 15,420 116,955
Tiempo de respuesta (promedio) 10.33s 68.43s
Tiempo de respuesta (máximo) 33.10s 376.10s
Tiempo de respuesta (total) 227.37s 1505.53s
Parámetros ~9.5T en total (~878B activos) 671B en total (37B activos)
Disponibilidad Código cerrado Código abierto

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 Claude Fable 5.1

low
Coste
$0.126
Tiempo
28.5s
Tokens
2,652 tok

#128 DeepSeek V3.2

medium
Coste
$0.001
Tiempo
53.6s
Tokens
1,932 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014

Comparación rápida

Cambiar par de comparación