टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #200 | Qwen3.7 Flash none | Qwen | 10.0 | 6.1 | $0.019 | 1/1 | 2.80s |
| #252 | GPT-5.6 Luna none | OpenAI | 10.0 | 5.4 | $0.029 | 1/1 | 2.80s |
| #307 | Elephant Alpha medium | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.83s |
| #85 | Gemini 3.5 Flash Lite medium | 10.0 | 7.8 | $0.272 | 1/1 | 2.84s | |
| #230 | Ling-3.0-flash none | Inclusionai | 10.0 | 5.7 | $0.004 | 1/1 | 2.85s |
| #62 | Inkling Small high | Thinkingmachines | 3.0 | 8.4 | $0.398 | 0/1 | 2.91s |
| #201 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 1/1 | 2.97s | |
| #208 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 1/1 | 2.99s |
| #181 | Laguna XS 2.1 medium | Poolside | 10.0 | 6.5 | $0.068 | 1/1 | 3.01s |
| #314 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/1 | 3.05s |
| #139 | Mercury 2.5 high | Inception | 10.0 | 7.1 | $0.031 | 1/1 | 3.06s |
| #212 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.280 | 1/1 | 3.10s |
| #137 | Step 3.7 Flash low | Stepfun | 10.0 | 7.1 | $0.390 | 1/1 | 3.25s |
| #36 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 1/1 | 3.27s | |
| #34 | Pareto none | Unbiased | 10.0 | 8.9 | $1.172 | 1/1 | 3.29s |