Navegação
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 Max (0902) (low) vs MiMo-V2.6-Pro (medium)

MiMo-V2.6-Pro (medium) lidera na pontuação média com 8.7 vs 8.6. MiMo-V2.6-Pro (medium) tem menor custo de benchmark com $0.586 vs $1.131. Qwen3.8 Max (0902) (low) é mais rápido com 29.07s vs 148.11s, com taxas de acerto de 85.5% vs 78.3%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-01

Modelos comparados

Posição
#63
Total de tokens de saída
88,923
Tempo de resposta (médio)
29.07s
Custo total
$1.131
Posição
#56
Total de tokens de saída
523,680
Tempo de resposta (médio)
148.11s
Custo total
$0.586
Modelo recomendado Qwen3.8 Max (0902) (low)

A pontuação fica perto da melhor aqui (8.6 vs 8.7) e responde cerca de 5.1x mais rápido que MiMo-V2.6-Pro (medium).

Comparação detalhada

Métrica Qwen3.8 Max (0902) Qwen3.8 Max (0902) low Lançamento: 2026-09-07 MiMo-V2.6-Pro MiMo-V2.6-Pro medium Lançamento: 2026-09-22
Pontuação 8.6 8.7
Posição #63 #56
Confiabilidade 10.0 9.5
Consistência 9.0 7.6
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 85.5% 78.3%
Testes instáveis 3 7
Execuções totais 69 69
Custo por resultado 6.283 4.182
Custo total $1.131 $0.586
Preço de entrada $2.000 / 1M $0.435 / 1M
Preço de saída $6.000 / 1M $0.870 / 1M
Total de tokens de entrada 298,682 298,476
Tokens de saída 8,374 7,762
Tokens de raciocínio 80,549 515,918
Tempo de resposta (médio) 29.07s 148.11s
Tempo de resposta (máx.) 207.79s 904.91s
Tempo de resposta (total) 668.66s 3406.53s
Parâmetros 2.4T no total (~100B ativos) 1.02T no total (42B ativos)
Disponibilidade Código fechado Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#63 Qwen3.8 Max (0902)

low
Custo
$0.014
Tempo
41.2s
Tokens
2,421 tok

#56 MiMo-V2.6-Pro

medium
Custo
$0.012
Tempo
185.6s
Tokens
13,493 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404
MiMo-V2.6-Pro 8.2 7.2 88.9% 1 150.44s 7,422 785 94,571

Comparação rápida

Trocar par de comparação