टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #13 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.137 | 1/1 | 10.6s |
| #14 | Gemini 3.5 Flash low | 10.0 | 8.9 | $0.433 | 1/1 | 3.27s | |
| #15 | Grok 4.5 high | X AI | 10.0 | 8.9 | $1.707 | 1/1 | 5.71s |
| #16 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.920 | 1/1 | 6.37s |
| #17 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.931 | 1/1 | 8.96s |
| #18 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.477 | 1/1 | 4.17s |
| #20 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.478 | 1/1 | 17.0s |
| #21 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.533 | 1/1 | 13.3s |
| #22 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.4 | $1.143 | 1/1 | 18.3s |
| #23 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.935 | 1/1 | 5.83s |
| #25 | Grok 4.5 medium | X AI | 10.0 | 8.3 | $1.928 | 1/1 | 6.57s |
| #26 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.3 | $0.922 | 1/1 | 10.7s |
| #28 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.643 | 1/1 | 6.20s | |
| #29 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.237 | 1/1 | 18.6s |
| #31 | Gemini 3.5 Flash-Lite high | 10.0 | 8.1 | $0.584 | 1/1 | 4.05s |