AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-24

Métrica	GPT-5.5 GPT-5.5 medium Lanzamiento: 2026-04-24	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lanzamiento: 2026-02-15

Métrica	GPT-5.5 GPT-5.5 medium Lanzamiento: 2026-04-24	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lanzamiento: 2026-02-15
Puntuación	9.0	8.5
Rango	#5	#9
Fiabilidad	N/D	N/D
Consistencia	9.2	9.1
Pruebas correctas
Tasa de aciertos por intento	87.0%	83.3%
Pruebas inestables	2	2
Ejecuciones totales	54	54
Costo por resultado	19.226	1.566
Costo total	$2.884	$0.220
Precio de entrada	$5.000 / 1M	$0.260 / 1M
Precio de salida	$30.000 / 1M	$1.560 / 1M
Tokens de salida	1,920	2,121
Tokens de razonamiento	89,632	111,889
Tiempo de respuesta (promedio)	32.75s	46.56s
Tiempo de respuesta (máximo)	332.10s	120.91s
Tiempo de respuesta (total)	589.59s	512.20s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		4.66s	250	1,335
Qwen3.5 Plus 2026-02-15	8.2	7.9	83.3%	1		45.78s	205	21,236

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		9.09s	318	1,391
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		120.91s	367	19,367

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		19.29s	312	2,841
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.85s	421	7,906

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		4.18s	234	593
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	270	14,916

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	5.3	7.2	44.4%	1		164.14s	67	79,625
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	35	16,680

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		4.16s	138	223
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	73	8,675

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		3.36s	93	538
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	101	7,704

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	8.6	7.9	77.8%	1		6.78s	250	2,254
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		34.57s	340	14,496

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
GPT-5.5	10.0	10.0	100.0%	0		10.57s	258	832
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	309	909

Comparación rápida

Cambiar par de comparación

Qwen3.5 Plus 2026-02-15mediumvsHY3 PreviewhighDisponible gratis Gemini 3 Flash PreviewlowvsGPT-5.5medium Claude Opus 4.7nonevsGPT-5.5medium Gemini 3 Flash PreviewlowvsQwen3.5 Plus 2026-02-15medium DeepSeek V4 ProhighvsQwen3.5 Plus 2026-02-15medium Qwen3.5 Plus 2026-02-15mediumvsHY3 PreviewlowDisponible gratis Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15medium GPT-5.5mediumvsHY3 PreviewhighDisponible gratis GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.7nonevsQwen3.5 Plus 2026-02-15medium