Navegación
Advertise here

GPT-5 Nano (medium) vs Qwen3.7 Flash

Qwen3.7 Flash lidera en puntuación media con 5.9 vs 5.7. Qwen3.7 Flash tiene menor coste de benchmark con $0.028 vs $0.139. Qwen3.7 Flash es más rápido con 14.70s vs 56.55s, con tasas de acierto de 53.6% vs 36.2%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-01

Modelos comparados

Rango
#254
Total de tokens de salida
307,921
Tiempo de respuesta (promedio)
56.55s
Costo total
$0.139
Rango
#248
Total de tokens de salida
117,742
Tiempo de respuesta (promedio)
14.70s
Costo total
$0.028
Modelo recomendado Qwen3.7 Flash

Tiene la mejor puntuación aquí (5.9) y cuesta aproximadamente 5.0x menos que GPT-5 Nano (medium).

Comparación detallada

Métrica GPT-5 Nano GPT-5 Nano medium Lanzamiento: 2025-08-07 Qwen3.7 Flash Qwen3.7 Flash none Lanzamiento: 2026-07-28
Puntuación 5.7 5.9
Rango #254 #248
Fiabilidad 10.0 10.0
Consistencia 6.5 9.0
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 53.6% 36.2%
Pruebas inestables 10 3
Ejecuciones totales 69 69
Costo por resultado 1.737 0.395
Costo total $0.139 $0.028
Precio de entrada $0.050 / 1M $0.030 / 1M
Precio de salida $0.400 / 1M $0.130 / 1M
Total de tokens de entrada 314,436 410,787
Tokens de salida 13,578 117,742
Tokens de razonamiento 294,343 0
Tiempo de respuesta (promedio) 56.55s 14.70s
Tiempo de respuesta (máximo) 227.89s 186.24s
Tiempo de respuesta (total) 961.32s 338.13s
Parámetros ~120B en total (~5B activos) ~35B en total (~3B activos)
Disponibilidad Código cerrado Código cerrado

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#254 GPT-5 Nano

medium
Coste
$0.006
Tiempo
108.5s
Tokens
13,209 tok

#248 Qwen3.7 Flash

none
Coste
$0.001
Tiempo
34.0s
Tokens
4,814 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152
Qwen3.7 Flash 5.5 10.0 33.3% 0 1.55s 7,911 855 0

Comparación rápida

Cambiar par de comparación