Navegación
AI BENCHY
Advertise here

Modelos comparados

Comparación benchmark Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B: Qwen3.8 27B (high) lidera en Puntuación con 8.4. Qwen3.8 27B (low) lidera en Fiabilidad con 10.0. Qwen3.8 27B tiene el Costo total más bajo con ~$0.006. Qwen3.8 27B es el más rápido con 3.12s.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-08-15

Rango
#42
Total de tokens de salida
656,635
Tiempo de respuesta (promedio)
167.89s
Costo total
~$0.287
Rango
#68
Total de tokens de salida
136,162
Tiempo de respuesta (promedio)
33.05s
Costo total
~$0.058
Rango
#61
Total de tokens de salida
169,329
Tiempo de respuesta (promedio)
39.11s
Costo total
~$0.071
Rango
#214
Total de tokens de salida
11,445
Tiempo de respuesta (promedio)
3.12s
Costo total
~$0.006
Modelo recomendado Qwen3.8 27B

Ofrece el mejor equilibrio general: puntuación competitiva (5.5), menor coste que los otros modelos de esta comparación y tiempo de respuesta equilibrado.

Comparación detallada

Métrica Qwen3.8 27B Qwen3.8 27B high Lanzamiento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B medium Lanzamiento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B low Lanzamiento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B none Lanzamiento: 2026-08-14
Puntuación 8.4 7.8 7.9 5.5
Rango #42 #68 #61 #214
Fiabilidad 9.6 9.6 10.0 10.0
Consistencia 9.2 9.7 10.0 10.0
Intentos 66/66 66/66 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 77.3% 66.7% 68.2% 40.9%
Pruebas inestables 2 1 0 0
Ejecuciones totales 66 66 66 66
Costo por resultado ~1.792 ~0.409 ~0.473 ~0.063
Costo total ~$0.287 ~$0.058 ~$0.071 ~$0.006
Precio de entrada N/D N/D N/D N/D
Precio de salida N/D N/D N/D N/D
Total de tokens de entrada 100,179 98,266 99,705 122,463
Tokens de salida 904 1,861 1,545 11,445
Tokens de razonamiento 655,731 134,301 167,784 0
Tiempo de respuesta (promedio) 167.89s 33.05s 39.11s 3.12s
Tiempo de respuesta (máximo) 640.85s 214.63s 376.04s 44.76s
Tiempo de respuesta (total) 3693.54s 694.04s 860.51s 68.69s
Parámetros 27.3B 27.3B 27.3B 27.3B
Disponibilidad Pesos disponibles Pesos disponibles Pesos disponibles Pesos disponibles

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Coste
~$0.008
Tiempo
270.1s
Tokens
18,963 tok

#68 Qwen3.8 27B

medium
Coste
~$0.002
Tiempo
43.4s
Tokens
2,956 tok

#61 Qwen3.8 27B

low
Coste
~$0.003
Tiempo
92.8s
Tokens
6,902 tok

#214 Qwen3.8 27B

none
Coste
~$0.001
Tiempo
23.9s
Tokens
1,922 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Comparación rápida

Cambiar par de comparación

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowClaude Opus 4.8lowvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BlowNemotron 3.5 LightninghighDisponible gratisvsQwen3.8 27BnoneKAT-Coder-Air V2.5mediumvsQwen3.8 27BnoneQwen3.8 27BhighvsGrok 4.6mediumGPT-5.6 TerrahighvsQwen3.8 27BlowSeed-2.0-CodelowvsQwen3.8 27Bmedium