Qwen3.6 35B A3B (medium) vs Step 3.7 Flash (high)

Modelo recomendado Qwen3.6 35B A3B (medium)

Su puntuación se mantiene cerca de la mejor aquí (6.7 vs 6.9) y cuesta aproximadamente 1.6x menos que Step 3.7 Flash (high).

Comparación detallada

Métrica	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lanzamiento: 2026-04-20	Step 3.7 Flash Step 3.7 Flash high Lanzamiento: 2026-05-29

Métrica	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lanzamiento: 2026-04-20	Step 3.7 Flash Step 3.7 Flash high Lanzamiento: 2026-05-29
Puntuación	6.7	6.9
Rango	#98	#94
Fiabilidad	10.0	10.0
Consistencia	9.6	8.0
Pruebas correctas
Tasa de aciertos por intento	60.6%	63.6%
Pruebas inestables	1	5
Ejecuciones totales	66	66
Costo por resultado	5.712	10.973
Costo total	$0.746	$1.207
Precio de entrada	$0.140 / 1M	$0.200 / 1M
Precio de salida	$1.000 / 1M	$1.150 / 1M
Total de tokens de entrada	85,139	98,691
Tokens de salida	61,819	1,032,395
Tokens de razonamiento	678,766	0
Tiempo de respuesta (promedio)	58.06s	64.68s
Tiempo de respuesta (máximo)	817.57s	364.99s
Tiempo de respuesta (total)	1161.18s	1423.01s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

medium

SVG inválido

high

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	672	1,154	12,385
Step 3.7 Flash	10.0	10.0	100.0%	0		13.40s	696	42,656	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	7.7	10.0	66.7%	0		50.55s	5,051	7,929	37,223
Step 3.7 Flash	4.0	6.0	22.2%	1		206.21s	6,057	327,340	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		817.57s	68,754	42,187	548,547
Step 3.7 Flash	8.7	6.9	83.3%	1		41.23s	73,938	49,842	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	7,776	2,591	9,968
Step 3.7 Flash	10.0	10.0	100.0%	0		14.72s	7,368	23,113	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	771	6,193	39,116
Step 3.7 Flash	4.1	4.4	44.5%	2		149.64s	783	410,502	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	516	129	4,569
Step 3.7 Flash	5.5	10.0	0.0%	0		4.17s	510	2,862	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	699	219	7,404
Step 3.7 Flash	9.8	10.0	100.0%	0		1.52s	705	2,010	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	8.0	10.0	66.7%	0		5.95s	696	655	9,228
Step 3.7 Flash	5.3	7.2	44.4%	1		10.22s	711	25,422	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0
Step 3.7 Flash	10.0	10.0	100.0%	0		2.79s	7,701	1,172	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	204	762	10,326
Step 3.7 Flash	3.0	10.0	0.0%	0		149.34s	222	147,476	0

Cambiar par de comparación