AI BENCHY
Your ad here

Categoria AI BENCHY

Ranking de Específico do domínio

Veja quais modelos de IA vão melhor em Específico do domínio, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↓.

Modelos exibidos

15

Média de Pontuação de Específico do domínio

4.8

Melhor modelo

MiniMax M2.5 2.9
Posição Modelo Empresa Pontuação de Específico do domínio Pontuação Testes corretos Tempo de resposta (médio)
#71 MiniMax M2.5 medium Minimax 2.9 5.7 0/3 237.3s
#57 GPT-5 Nano medium OpenAI 5.2 6.3 1/3 204.0s
#34 Kimi K2.6 medium Moonshot AI 5.3 7.7 1/3 202.4s
#93 GLM 4.7 Flash medium Z.ai 3.5 4.6 0/3 174.6s
#30 Step 3.5 Flash medium Stepfun 5.3 7.9 1/3 170.5s
#32 Qwen3.5-Flash medium Qwen 5.3 7.8 1/3 146.5s
#97 Qwen3.5-9B medium Qwen 3.6 4.4 0/3 137.7s
#46 Kimi K2.5 medium Moonshot AI 3.5 7.0 0/3 137.3s
#11 Gemini 3.1 Flash Lite Preview high Google 5.3 8.4 1/3 127.6s
#52 Grok 4.1 Fast medium X AI 5.8 6.7 1/3 121.8s
#41 MiMo-V2-Flash medium Xiaomi 5.9 7.5 1/3 96.0s
#6 Seed-2.0-Lite medium Bytedance Seed 5.9 8.6 1/3 88.7s
#43 Qwen3.5-35B-A3B medium Qwen 4.1 7.4 0/3 88.3s
#37 Claude Opus 4.6 medium Anthropic 3.0 7.6 0/3 83.4s
#10 Qwen3.5-27B medium Qwen 5.3 8.4 1/3 79.5s

Melhores modelos por Pontuação de Específico do domínio

Pontuação de Específico do domínio vs custo total

Melhores modelos por Tempo de resposta (médio)