Ranking de Chamada de ferramentas
Veja quais modelos de IA vão melhor em Chamada de ferramentas, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↓.
216/216
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Chamada de ferramentas | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #63 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #91 | GPT-5.5 none | OpenAI | 10.0 | 6.9 | $0.544 | 1/1 | 3.90s |
| #12 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.642 | 1/1 | 3.81s | |
| #68 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.3 | $0.115 | 1/1 | 3.80s | |
| #87 | GPT-5.6 Sol none | OpenAI | 10.0 | 6.9 | $0.524 | 1/1 | 3.70s |
| #131 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 3.67s |
| #177 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #75 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 1/1 | 3.54s |
| #109 | Qwen3.5-27B none | Qwen | 10.0 | 6.5 | $0.090 | 1/1 | 3.54s |
| #126 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #173 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.096 | 1/1 | 3.50s |
| #186 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #204 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #112 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 1/1 | 3.39s | |
| #93 | Gemini 3 Flash Preview none | 10.0 | 6.8 | $0.085 | 1/1 | 3.35s |