टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #63 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #91 | GPT-5.5 none | OpenAI | 10.0 | 6.9 | $0.544 | 1/1 | 3.90s |
| #12 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.642 | 1/1 | 3.81s | |
| #68 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.3 | $0.115 | 1/1 | 3.80s | |
| #87 | GPT-5.6 Sol none | OpenAI | 10.0 | 6.9 | $0.524 | 1/1 | 3.70s |
| #131 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 3.67s |
| #177 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #75 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 1/1 | 3.54s |
| #109 | Qwen3.5-27B none | Qwen | 10.0 | 6.5 | $0.090 | 1/1 | 3.54s |
| #126 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #173 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.096 | 1/1 | 3.50s |
| #186 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #204 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #112 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 1/1 | 3.39s | |
| #93 | Gemini 3 Flash Preview none | 10.0 | 6.8 | $0.085 | 1/1 | 3.35s |