Navegación
Advertise here

GPT-5.6 Luna (high) vs Qwen3.8 Flash Next (low)

La puntuación media está prácticamente empatada en 8.0 vs 8.0. Qwen3.8 Flash Next (low) tiene menor coste de benchmark con ~$0.045 vs $0.118. GPT-5.6 Luna (high) es más rápido con 18.39s vs 23.66s, con tasas de acierto de 71.0% vs 79.7%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-05

Modelos comparados

Rango
#92
Total de tokens de salida
139,395
Tiempo de respuesta (promedio)
18.39s
Costo total
$0.118
Rango
#96
Total de tokens de salida
135,295
Tiempo de respuesta (promedio)
23.66s
Costo total
~$0.045
Modelo recomendado Qwen3.8 Flash Next (low)

Tiene la mejor puntuación aquí (8.0) y cuesta aproximadamente 2.6x menos que GPT-5.6 Luna (high).

Comparación detallada

Métrica GPT-5.6 Luna GPT-5.6 Luna high Lanzamiento: 2026-07-09 Qwen3.8 Flash Next Qwen3.8 Flash Next low Lanzamiento: 2026-10-04
Puntuación 8.0 8.0
Rango #92 #96
Fiabilidad 10.0 10.0
Consistencia 8.6 8.0
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 71.0% 79.7%
Pruebas inestables 4 6
Ejecuciones totales 69 69
Costo por resultado 5.882 ~0.299
Costo total $0.118 ~$0.045
Precio de entrada $0.200 / 1M N/D
Precio de salida $1.200 / 1M N/D
Precio de lectura de caché $0.020 / 1M N/D
Precio de escritura de caché $0.250 / 1M N/D
Total de tokens de entrada 197,896 342,163
Tokens de salida 6,211 1,518
Tokens de razonamiento 133,184 133,777
Tiempo de respuesta (promedio) 18.39s 23.66s
Tiempo de respuesta (máximo) 111.09s 166.72s
Tiempo de respuesta (total) 422.93s 544.16s
Parámetros ~400B en total (~17B activos) 180B en total (6B activos)
Disponibilidad Código cerrado Pesos disponibles

Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 GPT-5.6 Luna

high
Coste
$0.033
Tiempo
34.2s
Tokens
5,484 tok

#96 Qwen3.8 Flash Next

low
Coste
~$0.002
Tiempo
47.2s
Tokens
5,270 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

Comparación rápida

Cambiar par de comparación

Nemotron 3 UltramediumDisponible gratisvsGPT-5.6 LunahighGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsGPT-5.6 LunahighQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxGemini 3.8 FlashmediumvsGPT-5.6 LunahighClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumDisponible gratisvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsGPT-5.6 LunahighGPT-5.6 LunahighvsQwen3.5-27BmediumGPT-5.6 LunahighvsGLM 5.3 FlashXmax