टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #314 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/1 | 3.05s |
| #316 | Nemotron 3.5 Lightning none | NVIDIA | 2.8 | 4.0 | $0.007 | 0/1 | 1.70s |
| #317 | Grok Build 0.1 none | X AI | 3.0 | 4.0 | $0.547 | 0/1 | 0ms |
| #321 | Grok 4.1 Fast none | X AI | 2.8 | 3.8 | $0.008 | 0/1 | 5.51s |
| #324 | Laguna Xs.2 none | Poolside | 3.0 | 3.8 | $0.004 | 0/1 | 1.93s |
| #325 | gpt-oss-120b none | OpenAI | 3.0 | 3.7 | $0.033 | 0/1 | 0ms |
| #326 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 3.0 | 3.4 | $0.000 | 0/1 | 0ms |
| #327 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/1 | 0ms |
| #328 | Jev 1.13 none | Typesafe | 0.0 | 3.2 | $0.003 | 0/0 | 0ms |
| #329 | Step 3.5 Flash none | Stepfun | 3.0 | 2.3 | $0.020 | 0/1 | 0ms |
| #330 | LFM2-24B-A2B none | Liquid | 3.0 | 2.2 | $0.001 | 0/1 | 0ms |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 1/1 | 8.35s | |
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.595 | 1/1 | 42.6s | |
| #3 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $3.803 | 1/1 | 20.6s |
| #4 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $3.474 | 1/1 | 8.92s |