Google: Gemini 3 Flash Preview vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro (medium) lidera en puntuación media con 6.9 vs 6.8. Gemini 3 Flash Preview tiene menor coste de benchmark con $0.085 vs $0.187. Gemini 3 Flash Preview es más rápido con 2.95s vs 33.92s, con tasas de acierto de 65.2% vs 66.7%.

Modelo recomendadoGemini 3 Flash PreviewSu puntuación se mantiene cerca de la mejor aquí (6.8 vs 6.9) y cuesta aproximadamente 2.2x menos que MiMo-V2.5-Pro (medium).

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-21

Métrica	Gemini 3 Flash Preview Gemini 3 Flash Preview none Lanzamiento: 2025-12-17	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lanzamiento: 2026-04-22

Métrica	Gemini 3 Flash Preview Gemini 3 Flash Preview none Lanzamiento: 2025-12-17	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lanzamiento: 2026-04-22
Puntuación	6.8	6.9
Rango	#93	#88
Fiabilidad	10.0	10.0
Consistencia	8.9	8.2
Pruebas correctas
Tasa de aciertos por intento	65.2%	66.7%
Pruebas inestables	3	5
Ejecuciones totales	66	66
Costo por resultado	0.648	3.218
Costo total	$0.085	$0.187
Precio de entrada	$0.500 / 1M	$0.435 / 1M
Precio de salida	$3.000 / 1M	$0.870 / 1M
Total de tokens de entrada	104,210	139,883
Tokens de salida	10,710	15,521
Tokens de razonamiento	0	130,992
Tiempo de respuesta (promedio)	2.95s	33.92s
Tiempo de respuesta (máximo)	21.19s	197.54s
Tiempo de respuesta (total)	44.26s	746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Gemini 3 Flash Preview

none

Coste: $0.003
Tiempo: 5.6s
Tokens: 981 tok

#88 MiMo-V2.5-Pro

medium

SVG inválido

Coste: $0.000
Tiempo: 300.0s
Tokens: 0 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Categoría:

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	8.3	10.0	75.0%	0		1.25s	498	214	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.26s	621	323	1,179

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	5.5	10.0	33.3%	0		1.80s	8,122	453	0
MiMo-V2.5-Pro	6.2	4.7	66.7%	2		92.07s	6,543	780	51,218

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	3.8	1.6	50.0%	2		12.38s	80,061	9,175	0
MiMo-V2.5-Pro	6.9	5.9	66.7%	1		125.45s	114,089	10,854	45,120

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		1.41s	7,263	279	0
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	7,746	260	8,383

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	7.7	10.0	66.7%	0		963ms	643	18	0
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	630	275	17,023

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		1.13s	490	104	0
MiMo-V2.5-Pro	5.5	10.0	0.0%	0		4.02s	492	155	163

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	6.4	5.8	66.7%	1		1.58s	619	74	0
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	672	82	803

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	7.7	10.0	66.7%	0		1.05s	574	144	0
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.31s	660	540	2,181

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.35s	5,784	234	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	8,220	311	2,908

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemini 3 Flash Preview	3.0	10.0	0.0%	0		1.07s	156	15	0
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		12.46s	210	1,941	2,014

Comparación rápida

Cambiar par de comparación

GPT-5.6 SolnonevsMiMo-V2.5-Promedium DeepSeek V4 PrononevsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsQwen3.6 35B A3Bmedium Step 3.7 FlashhighvsMiMo-V2.5-Promedium GPT-5.5nonevsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsLongCat 2.0low Gemini 3.5 FlashminimalvsMiMo-V2.5-Promedium Gemini 3.5 FlashnonevsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsStep 3.7 Flashhigh Gemini 3 Flash PreviewnonevsQwen3.6 Flashmedium Gemini 3 Flash PreviewnonevsLongCat 2.0high Gemini 3 Flash PreviewnonevsKAT-Coder-Pro V2.5medium