AI BENCHY
Comparar Gráficos Metodologia
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Falhas AI BENCHY

Falhas por Erro de API

Veja quais modelos de IA encontram Erro de API com mais frequência para identificar riscos de confiabilidade antes de escolher. Ordenar por: Contagem de falhas ↑.

Modelos exibidos

5

Falhas totais

8

Modelo mais afetado

MiMo-V2-Flash 1
Posição Modelo Empresa Contagem de Erro de API Pontuação média Testes corretos Tempo de resposta (médio)
#21 MiMo-V2-Flash medium Xiaomi 1 7.2 11/16 25.3s
#24 Qwen3.5-Flash medium Qwen 1 6.9 10/16 70.8s
#35 Qwen3.5-35B-A3B medium Qwen 1 5.5 8/16 43.9s
#54 MiMo-V2-Flash none Xiaomi 1 2.9 3/16 2.97s
#55 LFM2-24B-A2B none Liquid 4 2.6 1/16 811ms

Melhores modelos por Contagem de Erro de API

Contagem de Erro de API vs pontuação média

Melhores modelos por Tempo de resposta (médio)