AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.6 35B A3B

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-22

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lanzamiento: 2026-02-17	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lanzamiento: 2026-04-20

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lanzamiento: 2026-02-17	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lanzamiento: 2026-04-20
Puntuación	7.0	7.8
Rango	#69	#30
Fiabilidad	10.0	9.4
Consistencia	9.7	9.1
Pruebas correctas
Tasa de aciertos por intento	58.3%	70.4%
Pruebas inestables	1	2
Ejecuciones totales	60	60
Costo por resultado	2.782	1.050
Costo total	$0.306	$0.126
Precio de entrada	$3.000 / 1M	$0.150 / 1M
Precio de salida	$15.000 / 1M	$1.000 / 1M
Tokens de salida	9,453	18,325
Tokens de razonamiento	0	115,750
Tiempo de respuesta (promedio)	5.33s	17.26s
Tiempo de respuesta (máximo)	23.84s	86.11s
Tiempo de respuesta (total)	69.29s	310.77s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	1,214	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	1,154	12,385

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	6.8	10.0	50.0%	0		6.73s	2,112	0
Qwen3.6 35B A3B	6.6	10.0	50.0%	0		59.35s	6,601	22,535

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	3,766	0
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	252	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	2,591	9,968

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	413	0
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	6,193	39,116

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	192	0
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	129	4,569

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	90	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	219	7,404

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.92s	536	0
Qwen3.6 35B A3B	7.9	7.5	77.8%	1		5.98s	676	9,447

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	447	0
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	431	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	762	10,326

Comparación rápida

Cambiar par de comparación

Claude Sonnet 4.6nonevsQwen3.5-35B-A3Bmedium Claude Sonnet 4.6nonevsSeed-2.0-Minimedium Claude Sonnet 4.6nonevsMiMo-V2-Flashmedium Claude Sonnet 4.6nonevsDeepSeek V3.2medium Claude Sonnet 4.6nonevsGPT-5.4 Minimedium Claude Sonnet 4.6nonevsMiMo-V2-Omnimedium Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium Claude Sonnet 4.6nonevsGPT-5 Minimedium Gemini 3 Flash PreviewnonevsQwen3.6 35B A3Bmedium Gemini 3.5 FlashminimalvsQwen3.6 35B A3Bmedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 35B A3Bmedium GPT-5.2 ChatnonevsQwen3.6 35B A3Bmedium