टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #249 | DeepSeek V4.1 Flash none | DeepSeek | 10.0 | 5.4 | $0.370 | 1/1 | 3.76s |
| #113 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s | |
| #27 | Gemini 3.5 Flash medium | 10.0 | 9.0 | $0.665 | 1/1 | 3.81s | |
| #225 | Solar Pro 4 none | Upstage | 10.0 | 5.8 | $0.017 | 1/1 | 3.83s |
| #46 | Muse Spark 1.2 medium | Meta | 10.0 | 8.6 | $1.339 | 1/1 | 3.89s |
| #144 | GPT-5.5 none | OpenAI | 10.0 | 7.0 | $0.544 | 1/1 | 3.90s |
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #226 | North Mini Code medium | Cohere | 10.0 | 5.7 | $0.000 | 1/1 | 3.93s |
| #193 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 1/1 | 3.94s |
| #45 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 1/1 | 4.00s |
| #154 | Qwen3.6 Flash medium | Qwen | 10.0 | 6.8 | $0.741 | 1/1 | 4.00s |
| #263 | Dots 3 Note Preview none | Dots Studio | 10.0 | 5.2 | $0.000 | 1/1 | 4.04s |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 1/1 | 4.10s | |
| #121 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |
| #81 | Step 3.7 Flash medium | Stepfun | 10.0 | 7.9 | $0.495 | 1/1 | 4.16s |