Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Qwen: Qwen3.5-Flash

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-17

Métrica Gemini 2.5 Flash Gemini 2.5 Flash medium Lanzamiento: 2025-06-17 Qwen3.5-Flash Qwen3.5-Flash medium Lanzamiento: 2026-02-24
Rango #13 #19
Puntuación 8.1 8.0
Consistencia 9.5 7.6
Costo por resultado 2.430 0.688
Costo total $0.292 $0.076
Pruebas correctas
Tasa de aciertos por intento 74.5% 82.4%
Pruebas inestables 1 5
Ejecuciones totales 51 51
Tokens de salida 1,376 1,827
Tokens de razonamiento 111,923 179,299
Tiempo de respuesta (promedio) 11.88s 67.96s
Tiempo de respuesta (máximo) 95.48s 234.29s
Tiempo de respuesta (total) 201.89s 1155.28s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
Qwen3.5-Flash 6.4 4.4 77.8% 2 56.74s 162 24,276
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284

Comparación rápida

Cambiar par de comparación