Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Xiaomi: MiMo-V2-Flash

Resumo

Comparação benchmark Gemini 3 Flash Preview vs MiMo-V2-Flash: Gemini 3 Flash Preview lidera na pontuação média com 9.6 vs 4.3. MiMo-V2-Flash tem menor custo de benchmark com $0.025 vs $0.667. MiMo-V2-Flash é mais rápido com 2.76s vs 18.64s, com taxas de acerto de 98.4% vs 25.4%.

Modelo recomendado: Gemini 3 Flash Preview - Tem a pontuação mais forte nesta comparação (9.6) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-02

Métrica Gemini 3 Flash Preview Gemini 3 Flash Preview medium Lançamento: 2025-12-17 MiMo-V2-Flash MiMo-V2-Flash none Lançamento: 2025-12-16
Pontuação 9.6 4.3
Posição #2 #164
Confiabilidade 10.0 6.7
Consistência 9.7 8.5
Testes corretos
Taxa de acerto por tentativa 98.4% 25.4%
Testes instáveis 1 4
Execuções totais 63 63
Custo por resultado 3.335 0.584
Custo total $0.667 $0.025
Preço de entrada $0.500 / 1M $0.100 / 1M
Preço de saída $3.000 / 1M $0.300 / 1M
Total de tokens de entrada 37,017 36,851
Tokens de saída 2,006 68,882
Tokens de raciocínio 214,153 0
Tempo de resposta (médio) 18.64s 2.76s
Tempo de resposta (máx.) 117.26s 19.68s
Tempo de resposta (total) 391.35s 46.99s

Geração showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
Custo
$0.010
Tempo
17.9s
Tokens
3,236 tok

#164 MiMo-V2-Flash

none
Custo
$0.001
Tempo
7.7s
Tokens
1,481 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 645 865 0
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
MiMo-V2-Flash 4.3 7.9 11.1% 1 2.64s 7,442 763 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 15,075 330 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 2,622 161 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 753 24 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 498 104 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 684 69 0
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
MiMo-V2-Flash 5.3 10.0 33.3% 0 1.86s 678 66,282 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 8,238 272 0
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.82s 216 12 0

Comparação rápida

Trocar par de comparação