Google: Gemini 3.5 Flash vs Qwen: Qwen3.6 Max Preview

Gemini 3.5 Flash (medium) lidera en puntuación media con 9.1 vs 8.4. Gemini 3.5 Flash (medium) tiene menor coste de benchmark con $0.642 vs $1.143. Gemini 3.5 Flash (medium) es más rápido con 8.20s vs 67.53s, con tasas de acierto de 87.9% vs 80.3%.

Modelo recomendadoGemini 3.5 Flash (medium)Tiene la mejor puntuación aquí (9.1) y cuesta aproximadamente 1.8x menos que Qwen3.6 Max Preview (medium).

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-25

Métrica	Gemini 3.5 Flash Gemini 3.5 Flash medium Lanzamiento: 2026-05-19	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lanzamiento: 2026-04-20

Métrica	Gemini 3.5 Flash Gemini 3.5 Flash medium Lanzamiento: 2026-05-19	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lanzamiento: 2026-04-20
Puntuación	9.1	8.4
Rango	#14	#25
Fiabilidad	10.0	9.9
Consistencia	9.7	8.9
Pruebas correctas
Tasa de aciertos por intento	87.9%	80.3%
Pruebas inestables	1	3
Ejecuciones totales	66	66
Costo por resultado	3.374	8.173
Costo total	$0.642	$1.143
Precio de entrada	$1.500 / 1M	$1.040 / 1M
Precio de salida	$9.000 / 1M	$6.240 / 1M
Total de tokens de entrada	69,747	79,240
Tokens de salida	2,166	5,098
Tokens de razonamiento	57,436	164,842
Tiempo de respuesta (promedio)	8.20s	67.53s
Tiempo de respuesta (máximo)	76.68s	238.07s
Tiempo de respuesta (total)	180.47s	1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#14 Gemini 3.5 Flash

medium

Coste: $0.201
Tiempo: 112.9s
Tokens: 22,371 tok

#25 Qwen3.6 Max Preview

medium

Coste: $0.024
Tiempo: 76.5s
Tokens: 3,861 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.09s	492	171	3,385
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	672	228	10,075

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	7.9	7.5	77.8%	1		12.63s	8,118	461	24,939
Qwen3.6 Max Preview	8.8	7.8	88.9%	1		146.48s	7,895	427	52,957

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		44.36s	45,684	516	8,835
Qwen3.6 Max Preview	7.3	5.8	83.3%	1		177.48s	51,812	3,215	35,050

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		4.07s	7,548	279	3,784
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	7,782	270	10,106

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	7.7	10.0	66.7%	0		5.24s	633	12	8,047
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	771	60	30,371

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.52s	486	115	1,144
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	516	129	3,510

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	9.9	10.0	100.0%	0		2.70s	615	71	2,855
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	699	103	5,848

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	7.7	10.0	66.7%	0		2.38s	558	295	2,747
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.32s	696	329	7,693

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.81s	5,457	234	455
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	8,193	309	1,571

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.75s	156	12	1,245
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		60.56s	204	28	7,661

Comparación rápida

Cambiar par de comparación

Qwen3.6 Max PreviewmediumvsGrok 4.5low Claude Opus 5highvsGemini 3.5 Flashmedium Claude Opus 5lowvsQwen3.6 Max Previewmedium Muse Spark 1.1lowvsQwen3.6 Max Previewmedium Gemini 3.5 FlashmediumvsGrok 4.5high Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.6 Solhigh Muse Spark 1.1highvsQwen3.6 Max Previewmedium Gemini 3.5 Flash-LitehighvsQwen3.6 Max Previewmedium Qwen3.6 Max PreviewmediumvsInklinghigh GPT-5.2 ChatnonevsQwen3.6 Max Previewmedium Gemini 3.5 FlashmediumvsGPT-5.6 Sollow