Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Google: Gemini 3 Flash Preview

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-15

Métrica Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Lanzamiento: 2026-03-03 Gemini 3 Flash Preview Gemini 3 Flash Preview none Lanzamiento: 2025-12-17
Rango #16 #19
Puntuación 8.0 7.9
Consistencia 10.0 9.0
Costo por resultado 0.443 0.169
Costo total $0.049 $0.019
Pruebas correctas
Tasa de aciertos por intento 68.8% 75.0%
Pruebas inestables 0 2
Ejecuciones totales 48 48
Tokens de salida 1,731 1,411
Tokens de razonamiento 25,821 0
Tiempo de respuesta (promedio) 3.83s 1.75s
Tiempo de respuesta (máximo) 14.93s 3.56s
Tiempo de respuesta (total) 61.25s 15.71s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 8.8 10.0 66.7% 0 2.53s 564 3,780
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.59s 208 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 14.93s 327 7,347
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 350 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.29s 279 2,952
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 279 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 4.21s 18 5,325
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 18 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.16s 96 1,488
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.91s 72 2,121
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 74 0
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 7.7 10.0 66.7% 0 3.58s 141 1,896
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.06s 144 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.80s 234 912
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0

Comparación rápida

Cambiar par de comparación