Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Mimo V2 Omni

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-03

Métrica Qwen3.7 Plus Qwen3.7 Plus none Lançamento: 2026-06-03 Mimo V2 Omni Mimo V2 Omni medium Lançamento: 2026-03-18
Pontuação 6.6 6.9
Posição #82 #75
Confiabilidade 10.0 10.0
Consistência 10.0 8.7
Testes corretos
Taxa de acerto por tentativa 50.0% 58.3%
Testes instáveis 0 3
Execuções totais 60 52
Custo por resultado 0.264 7.334
Custo total $0.027 $0.683
Preço de entrada $0.400 / 1M $1.722 / 1M
Preço de saída $1.600 / 1M $1.722 / 1M
Total de tokens de entrada 39,669 37,007
Tokens de saída 6,572 1,952
Tokens de raciocínio 0 357,306
Tempo de resposta (médio) 2.95s 41.16s
Tempo de resposta (máx.) 29.38s 299.23s
Tempo de resposta (total) 58.96s 823.26s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
Mimo V2 Omni 10.0 10.0 100.0% 0 2.75s 621 269 1,701
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 6.8 10.0 50.0% 0 2.77s 5,070 633 0
Mimo V2 Omni 3.4 4.8 16.7% 1 183.89s 4,787 292 174,314
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
Mimo V2 Omni 10.0 10.0 100.0% 0 25.87s 15,060 380 8,673
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
Mimo V2 Omni 10.0 10.0 100.0% 0 3.04s 6,002 155 591
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
Mimo V2 Omni 3.0 10.0 0.0% 0 47.89s 735 155 68,398
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
Mimo V2 Omni 5.4 2.5 66.7% 1 3.61s 492 136 492
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
Mimo V2 Omni 8.3 10.0 50.0% 0 4.99s 470 49 515
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
Mimo V2 Omni 5.9 7.2 55.6% 1 2.38s 410 210 860
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
Mimo V2 Omni 10.0 10.0 100.0% 0 13.98s 8,220 303 3,461
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0
Mimo V2 Omni 3.0 10.0 0.0% 0 234.19s 210 3 98,301

Comparação rápida

Trocar par de comparação