AI BENCHY Compare

Qwen3.6 Plus vs StepFun: Step 3.5 Flash

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-02

Métrica	Qwen3.6 Plus Qwen3.6 Plus medium Lanzamiento: 2026-04-02 Disponible gratis	Step 3.5 Flash Step 3.5 Flash medium Lanzamiento: 2026-02-01 Disponible gratis

Métrica	Qwen3.6 Plus Qwen3.6 Plus medium Lanzamiento: 2026-04-02 Disponible gratis	Step 3.5 Flash Step 3.5 Flash medium Lanzamiento: 2026-02-01 Disponible gratis
Puntuación	8.4	7.9
Rango	#9	#27
Consistencia	9.5	9.1
Pruebas correctas
Tasa de aciertos por intento	78.4%	70.6%
Pruebas inestables	1	2
Ejecuciones totales	51	49
Costo por resultado	0.000	0.000
Costo total	$0.000	$0.000
Precio de entrada	$0.000 / 1M	$0.100 / 1M
Precio de salida	$0.000 / 1M	$0.300 / 1M
Tokens de salida	1,763	71,904
Tokens de razonamiento	83,782	155,607
Tiempo de respuesta (promedio)	15.27s	26.78s
Tiempo de respuesta (máximo)	43.55s	170.45s
Tiempo de respuesta (total)	259.55s	294.58s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		9.90s	207	7,557
Step 3.5 Flash	10.0	10.0	100.0%	0		13.56s	14,376	17,668

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		34.95s	452	13,073
Step 3.5 Flash	10.0	10.0	100.0%	0		29.57s	1,176	12,984

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		14.95s	270	10,706
Step 3.5 Flash	10.0	10.0	100.0%	0		15.01s	600	13,886

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	2.9	7.2	11.1%	1		29.59s	56	33,464
Step 3.5 Flash	5.3	7.2	44.4%	1		170.45s	45,350	90,436

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	5.1	10.0	0.0%	0		27.05s	111	5,232
Step 3.5 Flash	5.5	10.0	0.0%	0		6.54s	2,214	2,584

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		7.54s	102	5,552
Step 3.5 Flash	8.5	6.8	83.3%	1		4.98s	2,284	3,412

Puzzle Solving	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		6.11s	298	6,868
Step 3.5 Flash	5.3	10.0	33.3%	0		7.72s	5,629	10,835

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Qwen3.6 Plus	10.0	10.0	100.0%	0		5.87s	267	1,330
Step 3.5 Flash	10.0	10.0	100.0%	0		11.91s	275	3,802

Comparación rápida

Cambiar par de comparación

Gemini 3.1 Flash Lite PreviewnonevsStep 3.5 FlashmediumDisponible gratis GPT-5.2 ChatnonevsStep 3.5 FlashmediumDisponible gratis Gemini 3 Flash PreviewnonevsStep 3.5 FlashmediumDisponible gratis Gemini 3.1 Flash Lite PreviewlowvsStep 3.5 FlashmediumDisponible gratis Gemini 3 Flash PreviewlowvsQwen3.6 PlusmediumDisponible gratis GPT-5.3 ChatnonevsStep 3.5 FlashmediumDisponible gratis Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 PlusmediumDisponible gratis Gemini 3 Flash PreviewnonevsQwen3.6 PlusmediumDisponible gratis Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 PlusmediumDisponible gratis Claude Sonnet 4.6nonevsStep 3.5 FlashmediumDisponible gratis GPT-5.2 ChatnonevsQwen3.6 PlusmediumDisponible gratis Gemini 3 Flash PreviewlowvsStep 3.5 FlashmediumDisponible gratis