AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Categoria AI BENCHY

Ranking de Específico do domínio

Veja quais modelos de IA vão melhor em Específico do domínio, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↓.

Modelos exibidos

15

Média de Pontuação de Específico do domínio

4.8

Melhor modelo

MiniMax M2.5 2.9
Posição Modelo Empresa Pontuação de Específico do domínio Pontuação Testes corretos Tempo de resposta (médio)
#27 Gemma 4 31B medium Google 7.7 7.8 2/3 38.5s
#70 GPT-5.4 Nano medium OpenAI 5.9 7.0 1/3 38.2s
#59 GLM 5V Turbo medium Z.ai 5.3 7.2 1/3 38.1s
#43 MiMo-V2.5-Pro medium Xiaomi 5.3 7.5 1/3 37.9s
#28 Gemini 2.5 Flash medium Google 5.9 7.8 1/3 37.3s
#126 gpt-oss-120b none OpenAI 3.0 5.4 0/3 35.0s
#83 Step 3.5 Flash none Stepfun 10.0 6.6 1/1 34.5s
#56 MiMo-V2.5 medium Xiaomi 5.3 7.3 1/3 34.5s
#4 Gemini 3.1 Pro Preview medium Google 7.7 9.4 2/3 32.7s
#55 GLM 5.1 medium Z.ai 5.3 7.3 1/3 29.8s
#26 Qwen3.6 Plus medium Qwen 2.9 7.9 0/3 29.6s
#6 GPT-5.5 low OpenAI 5.3 9.0 1/3 28.1s
#65 Grok 4.20 medium X AI 5.3 7.1 1/3 27.0s
#5 Qwen3.7 Max medium Qwen 5.9 9.1 1/3 24.9s
#41 Nemotron 3 Ultra 550b A55b medium NVIDIA 3.5 7.5 0/3 24.9s

Melhores modelos por Pontuação de Específico do domínio

Pontuação de Específico do domínio vs custo total

Melhores modelos por Tempo de resposta (médio)