Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Qwen: Qwen3.7 Plus

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-03

Métrica Gemini 3.5 Flash Gemini 3.5 Flash low Lanzamiento: 2026-05-19 Qwen3.7 Plus Qwen3.7 Plus medium Lanzamiento: 2026-06-03
Puntuación 9.3 8.4
Rango #3 #16
Fiabilidad 10.0 9.9
Consistencia 10.0 9.2
Pruebas correctas
Tasa de aciertos por intento 90.0% 80.0%
Pruebas inestables 0 2
Ejecuciones totales 60 60
Costo por resultado 1.582 1.324
Costo total $0.285 $0.199
Precio de entrada $1.500 / 1M $0.400 / 1M
Precio de salida $9.000 / 1M $1.600 / 1M
Total de tokens de entrada 33,935 38,104
Tokens de salida 2,027 2,107
Tokens de razonamiento 23,938 112,479
Tiempo de respuesta (promedio) 2.98s 36.84s
Tiempo de respuesta (máximo) 6.44s 178.04s
Tiempo de respuesta (total) 59.59s 736.86s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
Qwen3.7 Plus 10.0 10.0 100.0% 0 8.58s 672 195 5,065
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 5,115 452 6,839
Qwen3.7 Plus 6.5 5.9 66.7% 1 122.40s 3,637 396 30,301
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
Qwen3.7 Plus 10.0 10.0 100.0% 0 65.24s 14,934 366 10,132
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
Qwen3.7 Plus 10.0 10.0 100.0% 0 21.75s 7,782 270 6,713
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
Qwen3.7 Plus 3.6 7.2 22.2% 1 45.35s 771 57 27,073
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
Qwen3.7 Plus 10.0 10.0 100.0% 0 25.48s 516 123 3,998
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.13s 699 102 5,013
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
Qwen3.7 Plus 10.0 10.0 100.0% 0 16.38s 696 280 7,312
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
Qwen3.7 Plus 10.0 10.0 100.0% 0 15.02s 8,193 292 1,831
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690
Qwen3.7 Plus 3.0 10.0 0.0% 0 91.07s 204 26 15,041

Comparación rápida

Cambiar par de comparación