Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs MiniMax: MiniMax M2.5

Resumo

Comparação benchmark Gemini 3 Flash Preview vs MiniMax M2.5: Gemini 3 Flash Preview lidera na pontuação média com 9.6 vs 4.7. MiniMax M2.5 tem menor custo de benchmark com $0.164 vs $0.667. Gemini 3 Flash Preview é mais rápido com 18.64s vs 65.37s, com taxas de acerto de 98.4% vs 46.0%.

Modelo recomendado: Gemini 3 Flash Preview - Tem a melhor pontuação aqui (9.6) e responde cerca de 3.5x mais rápido que MiniMax M2.5.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-02

Métrica Gemini 3 Flash Preview Gemini 3 Flash Preview medium Lançamento: 2025-12-17 MiniMax M2.5 MiniMax M2.5 medium Lançamento: 2026-02-12
Pontuação 9.6 4.7
Posição #2 #151
Confiabilidade 10.0 10.0
Consistência 9.7 6.5
Testes corretos
Taxa de acerto por tentativa 98.4% 46.0%
Testes instáveis 1 9
Execuções totais 63 63
Custo por resultado 3.335 7.900
Custo total $0.667 $0.164
Preço de entrada $0.500 / 1M $0.120 / 1M
Preço de saída $3.000 / 1M $0.480 / 1M
Total de tokens de entrada 37,017 43,706
Tokens de saída 2,006 109,495
Tokens de raciocínio 214,153 330,814
Tempo de resposta (médio) 18.64s 65.37s
Tempo de resposta (máx.) 117.26s 251.36s
Tempo de resposta (total) 391.35s 849.76s

Geração showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
Custo
$0.010
Tempo
17.9s
Tokens
3,236 tok

#151 MiniMax M2.5

medium
SVG inválido
Custo
$0.000
Tempo
300.0s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535

Comparação rápida

Trocar par de comparação