Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-4o-mini vs Qwen: Qwen3.5-9B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-12

Métrica GPT-4o-mini GPT-4o-mini none Lançamento: 2024-07-18 Qwen3.5-9B Qwen3.5-9B medium Lançamento: 2026-03-02
Posição #55 #66
Pontuação média 4.0 2.6
Consistência 10.0 7.4
Custo por resultado 0.114 0.779
Custo total $0.005 $0.024
Testes corretos
Taxa de acerto por tentativa 25.0% 35.4%
Testes instáveis 0 5
Execuções totais 48 48
Tokens de saída 1,594 17,930
Tokens de raciocínio 0 139,706
Tempo de resposta (médio) 2.07s 71.44s
Tempo de resposta (máx.) 7.58s 226.38s
Tempo de resposta (total) 18.60s 928.77s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação média vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação média vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 4.0 10.0 33.3% 0 1.83s 180 0
Qwen3.5-9B 4.0 7.2 55.6% 1 31.54s 2,410 10,913
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 10.0 10.0 0.0% 0 7.58s 568 0
Qwen3.5-9B 10.0 10.0 0.0% 0 0ms 0 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 9.9 10.0 100.0% 0 1.27s 183 0
Qwen3.5-9B 5.0 5.6 33.3% 1 87.31s 1,383 32,113
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 10.0 10.0 0.0% 0 637ms 15 0
Qwen3.5-9B 10.0 7.2 22.2% 1 137.75s 11,549 48,475
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 3.0 10.0 0.0% 0 909ms 66 0
Qwen3.5-9B 10.0 1.6 33.3% 1 226.38s 0 30,695
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 4.5 10.0 0.0% 0 1.27s 69 0
Qwen3.5-9B 5.5 5.8 66.7% 1 17.15s 599 4,517
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 2.3 10.0 0.0% 0 1.30s 308 0
Qwen3.5-9B 10.0 10.0 0.0% 0 33.38s 1,545 11,844
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 205 0
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 444 1,149

Comparação rápida

Trocar par de comparação