Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Xiaomi: MiMo-V2-Pro

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-22

Métrica Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Lanzamiento: 2026-03-03 MiMo-V2-Pro MiMo-V2-Pro medium Lanzamiento: 2026-03-18
Puntuación 7.7 7.6
Rango #34 #44
Fiabilidad 10.0 9.5
Consistencia 10.0 7.9
Pruebas correctas
Tasa de aciertos por intento 65.0% 76.7%
Pruebas inestables 0 5
Ejecuciones totales 60 60
Costo por resultado 0.481 2.453
Costo total $0.063 $0.295
Precio de entrada $0.250 / 1M $1.000 / 1M
Precio de salida $1.500 / 1M $3.000 / 1M
Tokens de salida 2,204 2,556
Tokens de razonamiento 33,657 81,879
Tiempo de respuesta (promedio) 3.68s 22.19s
Tiempo de respuesta (máximo) 14.93s 136.29s
Tiempo de respuesta (total) 73.60s 443.77s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 9.1 10.0 75.0% 0 2.33s 570 4,305
MiMo-V2-Pro 10.0 10.0 100.0% 0 2.86s 251 1,154
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 6.8 10.0 50.0% 0 3.98s 455 5,510
MiMo-V2-Pro 7.5 6.0 83.3% 1 94.21s 527 37,424
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 14.93s 327 7,347
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.29s 279 2,952
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 4.21s 18 5,325
MiMo-V2-Pro 5.3 10.0 33.3% 0 8.82s 170 2,158
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.16s 96 1,488
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.92s 184 400
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.91s 72 2,121
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 7.7 10.0 66.7% 0 3.58s 141 1,896
MiMo-V2-Pro 6.4 4.4 77.8% 2 5.26s 410 1,700
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.80s 234 912
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 2.68s 12 1,801
MiMo-V2-Pro 3.0 10.0 0.0% 0 82.71s 28 15,842

Comparación rápida

Cambiar par de comparación