Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.5 Plus 2026-04-20

Resumo

Comparação benchmark Mistral Small 4 vs Qwen3.5 Plus 2026-04-20: Qwen3.5 Plus 2026-04-20 lidera na pontuação média com 5.7 vs 5.3. Qwen3.5 Plus 2026-04-20 tem menor custo de benchmark com $0.032 vs $0.068. Qwen3.5 Plus 2026-04-20 é mais rápido com 4.39s vs 9.40s, com taxas de acerto de 44.4% vs 41.3%.

Modelo recomendado: Qwen3.5 Plus 2026-04-20 - Tem a melhor pontuação aqui (5.7) e custa cerca de 2.1x menos que Mistral Small 4.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-10

Métrica Mistral Small 4 Mistral Small 4 medium Lançamento: 2026-03-16 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Lançamento: 2026-04-20
Pontuação 5.3 5.7
Posição #133 #115
Confiabilidade 10.0 10.0
Consistência 6.9 8.6
Testes corretos
Taxa de acerto por tentativa 44.4% 41.3%
Testes instáveis 8 4
Execuções totais 63 63
Custo por resultado 1.344 0.595
Custo total $0.068 $0.032
Preço de entrada $0.150 / 1M $0.300 / 1M
Preço de saída $0.600 / 1M $1.800 / 1M
Total de tokens de entrada 42,576 38,910
Tokens de saída 24,184 11,145
Tokens de raciocínio 84,678 0
Tempo de resposta (médio) 9.40s 4.39s
Tempo de resposta (máx.) 59.15s 33.34s
Tempo de resposta (total) 197.39s 92.26s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#115 Qwen3.5 Plus 2026-04-20

none
Cost
$0.008
Time
77.0s
Tokens
4,369 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Qwen3.5 Plus 2026-04-20 4.8 10.0 25.0% 0 1.88s 696 557 0
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Qwen3.5 Plus 2026-04-20 2.8 1.6 33.3% 1 13.32s 11,350 2,275 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 2.82s 7,794 243 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Qwen3.5 Plus 2026-04-20 5.3 10.0 33.3% 0 4.43s 789 18 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Qwen3.5 Plus 2026-04-20 4.8 10.0 0.0% 0 1.41s 522 119 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Qwen3.5 Plus 2026-04-20 6.2 5.8 66.7% 1 1.17s 711 68 0
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Qwen3.5 Plus 2026-04-20 6.7 7.9 55.6% 1 1.97s 714 583 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 4.42s 8,211 297 0
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 33.34s 210 6,505 0

Comparação rápida

Trocar par de comparação