AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.6 27B

Resumen

Comparación benchmark de GPT-5.4 Nano vs Qwen3.6 27B: GPT-5.4 Nano lidera en puntuación media con 7.0 vs 6.8. GPT-5.4 Nano tiene menor coste de benchmark con $0.107 vs $0.336. GPT-5.4 Nano es más rápido con 11.95s vs 59.71s, con tasas de acierto de 63.5% vs 60.3%.

Modelo recomendado: GPT-5.4 Nano - Tiene la mejor puntuación aquí (7.0) y cuesta aproximadamente 3.2x menos que Qwen3.6 27B.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-10

Métrica	GPT-5.4 Nano GPT-5.4 Nano medium Lanzamiento: 2026-03-17	Qwen3.6 27B Qwen3.6 27B medium Lanzamiento: 2026-04-20

Métrica	GPT-5.4 Nano GPT-5.4 Nano medium Lanzamiento: 2026-03-17	Qwen3.6 27B Qwen3.6 27B medium Lanzamiento: 2026-04-20
Puntuación	7.0	6.8
Rango	#71	#79
Fiabilidad	10.0	10.0
Consistencia	8.4	8.2
Pruebas correctas
Tasa de aciertos por intento	63.5%	60.3%
Pruebas inestables	4	5
Ejecuciones totales	63	63
Costo por resultado	0.969	3.361
Costo total	$0.107	$0.336
Precio de entrada	$0.200 / 1M	$0.290 / 1M
Precio de salida	$1.250 / 1M	$2.400 / 1M
Total de tokens de entrada	35,434	39,376
Tokens de salida	3,014	16,189
Tokens de razonamiento	76,520	122,521
Tiempo de respuesta (promedio)	11.95s	59.71s
Tiempo de respuesta (máximo)	94.06s	168.22s
Tiempo de respuesta (total)	250.98s	1254.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 GPT-5.4 Nano

medium

Cost: $0.007
Time: 24.6s
Tokens: 4,943 tok

#79 Qwen3.6 27B

medium

Cost: $0.009
Time: 39.6s
Tokens: 3,090 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	8.3	10.0	75.0%	0		4.52s	606	683	2,254
Qwen3.6 27B	8.3	10.0	75.0%	0		12.62s	453	582	4,311

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	6.1	4.7	66.7%	2		19.12s	7,305	516	20,778
Qwen3.6 27B	7.7	10.0	66.7%	0		142.99s	5,051	7,968	43,367

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	9.8	10.0	100.0%	0		24.13s	12,345	349	5,719
Qwen3.6 27B	7.0	3.7	66.7%	1		83.07s	15,104	2,088	14,689

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	10.0	10.0	100.0%	0		2.54s	7,140	234	516
Qwen3.6 27B	3.5	1.4	50.0%	2		37.30s	7,778	568	9,404

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	5.9	7.2	55.6%	1		38.18s	619	60	43,325
Qwen3.6 27B	2.9	7.2	11.1%	1		73.38s	662	3,510	20,352

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	4.5	10.0	0.0%	0		4.15s	477	179	443
Qwen3.6 27B	6.5	3.4	66.7%	1		39.53s	516	81	3,045

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	9.8	10.0	100.0%	0		1.88s	660	95	521
Qwen3.6 27B	10.0	10.0	100.0%	0		37.96s	699	346	6,548

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	4.1	7.2	22.2%	1		3.79s	642	594	1,408
Qwen3.6 27B	7.7	10.0	66.7%	0		61.14s	696	255	12,044

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	10.0	10.0	100.0%	0		7.71s	5,445	234	382
Qwen3.6 27B	10.0	10.0	100.0%	0		16.88s	8,213	390	2,954

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
GPT-5.4 Nano	3.0	10.0	0.0%	0		4.81s	195	70	1,174
Qwen3.6 27B	3.0	10.0	0.0%	0		80.99s	204	401	5,807

Comparación rápida

Cambiar par de comparación

GPT-5.4 NanomediumvsStep 3.7 Flashhigh Claude Opus 4.8nonevsGPT-5.4 Nanomedium Claude Sonnet 4.6nonevsQwen3.6 27Bmedium GPT-5.4 NanomediumvsQwen3.6 Max Previewnone Gemini 3.1 Flash LitelowvsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewnonevsGPT-5.4 Nanomedium Gemma 4 31BnoneDisponible gratisvsQwen3.6 27Bmedium GPT-5.4 NanomediumvsStep 3.7 Flashlow Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium Qwen3.6 27BmediumvsStep 3.7 Flashhigh Claude Opus 4.8nonevsQwen3.6 27Bmedium Gemini 3.1 Flash LiteminimalvsQwen3.6 27Bmedium