Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.5 Plus 2026-02-15

Qwen3.5 Plus 2026-02-15 (medium) lidera en puntuación media con 7.5 vs 7.3. Qwen3.5 Plus 2026-02-15 (medium) tiene menor coste de benchmark con $0.437 vs $0.661. Claude Sonnet 4.6 es más rápido con 8.12s vs 89.19s, con tasas de acierto de 57.6% vs 71.2%.

Modelo recomendadoClaude Sonnet 4.6Su puntuación se mantiene cerca de la mejor aquí (7.3 vs 7.5) y responde aproximadamente 11.0x más rápido que Qwen3.5 Plus 2026-02-15 (medium).

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-17

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lanzamiento: 2026-02-17	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lanzamiento: 2026-02-15

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lanzamiento: 2026-02-17	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lanzamiento: 2026-02-15
Puntuación	7.3	7.5
Rango	#60	#55
Fiabilidad	10.0	10.0
Consistencia	9.7	8.5
Pruebas correctas
Tasa de aciertos por intento	57.6%	71.2%
Pruebas inestables	1	4
Ejecuciones totales	66	66
Costo por resultado	5.502	3.348
Costo total	$0.661	$0.437
Precio de entrada	$3.000 / 1M	$0.260 / 1M
Precio de salida	$15.000 / 1M	$1.560 / 1M
Total de tokens de entrada	123,264	113,560
Tokens de salida	19,362	9,823
Tokens de razonamiento	0	250,881
Tiempo de respuesta (promedio)	8.12s	89.19s
Tiempo de respuesta (máximo)	51.18s	304.85s
Tiempo de respuesta (total)	121.78s	1337.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Claude Sonnet 4.6

none

Coste: $0.038
Tiempo: 27.3s
Tokens: 2,598 tok

#55 Qwen3.5 Plus 2026-02-15

medium

Coste: $0.011
Tiempo: 125.5s
Tokens: 7,040 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
Qwen3.5 Plus 2026-02-15	8.2	7.9	83.3%	1		45.78s	672	205	21,236

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
Qwen3.5 Plus 2026-02-15	6.6	7.1	44.4%	1		180.70s	6,950	420	80,595

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	9.8	10.0	100.0%	0		37.51s	91,402	13,663	0
Qwen3.5 Plus 2026-02-15	6.9	5.9	66.7%	1		175.85s	87,576	8,085	69,183

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	7,782	270	14,916

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	444	35	16,680

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	344	73	8,675

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	699	101	7,704

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		32.50s	696	301	13,853

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	8,193	309	909

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		103.81s	204	24	17,130

Comparación rápida

Cambiar par de comparación