टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #126 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 1/1 | 3.54s |
| #188 | MiMo-V2.5 medium | Xiaomi | 10.0 | 6.4 | $0.104 | 1/1 | 7.29s |
| #190 | Ring-2.6-1T medium | Inclusionai | 10.0 | 6.4 | $0.102 | 1/1 | 104.4s |
| #254 | Kimi K2.5 none | Moonshot AI | 10.0 | 5.4 | $0.101 | 1/1 | 14.0s |
| #194 | Gemma 4 31B medium | 3.0 | 6.2 | $0.100 | 0/1 | 0ms | |
| #268 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |
| #222 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 2.32s |
| #145 | Mercury 2 medium | Inception | 10.0 | 7.0 | $0.094 | 1/1 | 1.89s |
| #208 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 1/1 | 2.99s |
| #223 | Seed 2.1 Turbo none | Bytedance Seed | 10.0 | 5.9 | $0.092 | 1/1 | 20.3s |
| #303 | Grok 4.20 Beta none | X AI | 10.0 | 4.4 | $0.087 | 1/1 | 4.79s |
| #163 | Gemini 3 Flash Preview none | 10.0 | 6.8 | $0.085 | 1/1 | 3.35s | |
| #164 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.084 | 1/1 | 9.01s | |
| #278 | Laguna S 2.1 low | Poolside | 10.0 | 5.0 | $0.082 | 1/1 | 2.36s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 10.0 | 7.0 | $0.078 | 1/1 | 34.8s |