टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 1/1 | 5.21s |
| #32 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.988 | 1/1 | 6.37s |
| #33 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |
| #34 | Pareto none | Unbiased | 10.0 | 8.9 | $1.172 | 1/1 | 3.29s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 1/1 | 26.0s |
| #36 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 1/1 | 3.27s | |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 1/1 | 5.93s |
| #38 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #39 | Gemini 3.5 Flash Lite high | 10.0 | 8.8 | $0.540 | 1/1 | 4.55s | |
| #40 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 1/1 | 8.96s |
| #41 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 1/1 | 9.03s |
| #42 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.251 | 1/1 | 4.40s | |
| #43 | GLM 5.3 Flash max | Z.ai | 10.0 | 8.7 | $0.071 | 1/1 | 19.2s |
| #44 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 1/1 | 4.17s |
| #45 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 1/1 | 4.00s |