Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Grok 4.20 Beta

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-26

Métrica Gemini 3 Flash Preview Gemini 3 Flash Preview medium Lanzamiento: 2025-12-17 Grok 4.20 Beta Grok 4.20 Beta none Lanzamiento: 2026-03-12
Puntuación 10.0 5.3
Rango #1 #93
Fiabilidad N/D N/D
Consistencia 10.0 9.2
Pruebas correctas
Tasa de aciertos por intento 100.0% 29.6%
Pruebas inestables 0 2
Ejecuciones totales 18 52
Costo por resultado 0.600 2.255
Costo total $0.108 $0.091
Precio de entrada $0.500 / 1M $0.000 / 1M
Precio de salida $3.000 / 1M $0.000 / 1M
Tokens de salida 655 1,591
Tokens de razonamiento 33,749 0
Tiempo de respuesta (promedio) 12.11s 1.19s
Tiempo de respuesta (máximo) 82.37s 6.48s
Tiempo de respuesta (total) 217.93s 21.37s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.26s 110 1,076
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 251 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 82.37s 144 16,257
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 74 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 23.58s 117 3,495
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 7.62s 93 2,197
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 14.81s 4 7,228
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.34s 24 635
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.30s 24 903
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.86s 61 1,455
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.78s 78 503
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

Comparación rápida

Cambiar par de comparación