Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Xiaomi: MiMo-V2-Pro

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-29

Métrica Gemini 2.5 Flash Gemini 2.5 Flash medium Lanzamiento: 2025-06-17 MiMo-V2-Pro MiMo-V2-Pro medium Lanzamiento: 2026-03-18
Puntuación 7.7 7.6
Rango #42 #52
Fiabilidad 10.0 9.6
Consistencia 9.6 7.9
Pruebas correctas
Tasa de aciertos por intento 68.3% 76.7%
Pruebas inestables 1 5
Ejecuciones totales 60 60
Costo por resultado 2.750 2.450
Costo total $0.358 $0.294
Precio de entrada $0.300 / 1M $1.000 / 1M
Precio de salida $2.500 / 1M $3.000 / 1M
Tokens de salida 1,924 2,518
Tokens de razonamiento 137,255 81,801
Tiempo de respuesta (promedio) 15.57s 22.16s
Tiempo de respuesta (máximo) 95.48s 136.29s
Tiempo de respuesta (total) 311.47s 443.22s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
MiMo-V2-Pro 10.0 10.0 100.0% 0 2.86s 251 1,154
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 6.6 10.0 50.0% 0 54.56s 537 24,413
MiMo-V2-Pro 7.5 6.0 83.3% 1 94.21s 527 37,424
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
MiMo-V2-Pro 5.3 10.0 33.3% 0 8.82s 170 2,158
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.92s 184 400
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.18s 126 2,499
MiMo-V2-Pro 6.4 4.4 77.8% 2 5.08s 372 1,622
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 3.0 10.0 0.0% 0 2.76s 11 919
MiMo-V2-Pro 3.0 10.0 0.0% 0 82.71s 28 15,842

Comparación rápida

Cambiar par de comparación