AI BENCHY
Advertise here

Categoria AI BENCHY

Ranking de Chamada de ferramentas

Veja quais modelos de IA vão melhor em Chamada de ferramentas, quais permanecem confiáveis e onde aparecem as maiores diferenças.

Modelos exibidos

15

Média de Pontuação de Chamada de ferramentas

8.7

Posição Modelo Empresa Pontuação de Chamada de ferramentas Pontuação Testes corretos Tempo de resposta (médio)
#35 Gemini 3 PRO Preview medium Google 10.0 7.6 1/1 12.0s
#36 Qwen3.5 Plus 2026-04-20 medium Qwen 10.0 7.6 1/1 14.7s
#37 Gemma 4 26B A4B medium Google 10.0 7.6 1/1 9.01s
#38 Grok 4.3 medium X AI 10.0 7.6 1/1 17.7s
#39 Qwen3.6 Flash medium Qwen 10.0 7.5 1/1 4.00s
#40 Gemini 3.1 Flash Lite Preview medium Google 10.0 7.5 1/1 3.80s
#41 Nemotron 3 Ultra 550b A55b medium NVIDIA 10.0 7.5 1/1 7.72s
#43 MiMo-V2.5-Pro medium Xiaomi 10.0 7.5 1/1 16.9s
#44 Gemini 3.1 Flash Lite medium Google 10.0 7.5 1/1 4.55s
#47 Grok Build 0.1 medium X AI 10.0 7.4 1/1 13.1s
#48 Gemini 3 Flash Preview none Google 10.0 7.4 1/1 3.35s
#49 Qwen3.5-Flash medium Qwen 10.0 7.4 1/1 10.3s
#50 Gemini 3.1 Flash Lite Preview low Google 10.0 7.4 1/1 9.54s
#51 Mimo V2 PRO medium Xiaomi 10.0 7.4 1/1 8.19s
#52 Claude Sonnet 4.6 medium Anthropic 10.0 7.4 1/1 7.48s

Melhores modelos por Pontuação de Chamada de ferramentas

Pontuação de Chamada de ferramentas vs custo total

Melhores modelos por Tempo de resposta (médio)