टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #34 | Pareto none | Unbiased | 10.0 | 8.9 | $1.172 | 1/1 | 3.29s |
| #36 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 1/1 | 3.27s | |
| #137 | Step 3.7 Flash low | Stepfun | 10.0 | 7.1 | $0.390 | 1/1 | 3.25s |
| #212 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.280 | 1/1 | 3.10s |
| #139 | Mercury 2.5 high | Inception | 10.0 | 7.1 | $0.031 | 1/1 | 3.06s |
| #314 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/1 | 3.05s |
| #181 | Laguna XS 2.1 medium | Poolside | 10.0 | 6.5 | $0.068 | 1/1 | 3.01s |
| #208 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 1/1 | 2.99s |
| #201 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 1/1 | 2.97s | |
| #62 | Inkling Small high | Thinkingmachines | 3.0 | 8.4 | $0.398 | 0/1 | 2.91s |
| #230 | Ling-3.0-flash none | Inclusionai | 10.0 | 5.7 | $0.004 | 1/1 | 2.85s |
| #85 | Gemini 3.5 Flash Lite medium | 10.0 | 7.8 | $0.272 | 1/1 | 2.84s | |
| #307 | Elephant Alpha medium | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.83s |
| #252 | GPT-5.6 Luna none | OpenAI | 10.0 | 5.4 | $0.029 | 1/1 | 2.80s |
| #200 | Qwen3.7 Flash none | Qwen | 10.0 | 6.1 | $0.019 | 1/1 | 2.80s |