संयुक्त: अमान्य टूल कॉल
संयुक्त
अमान्य टूल कॉल
देखें कि संयुक्त में किन AI मॉडलों में अमान्य टूल कॉल आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↑.
विफलता के कारण
श्रेणियाँ
77/77
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | अमान्य टूल कॉल संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #27 | Muse Spark 1.1 high | Meta | 2 | 5.9 | $1.694 | 0/2 | 70.3s |
| #88 | Gemini 3.5 Flash minimal | 2 | 3.0 | $0.300 | 0/2 | 14.4s | |
| #90 | Qwen3.6 35B A3B medium | Qwen | 1 | 3.0 | $0.746 | 0/2 | 817.6s |
| #92 | KAT-Coder-Pro V2.5 none | Kwaipilot | 1 | 4.1 | $0.476 | 0/2 | 183.1s |
| #93 | GLM 5V Turbo medium | Z.ai | 1 | 3.4 | $0.457 | 0/1 | 15.1s |
| #99 | Qwen3.6 27B medium | Qwen | 2 | 6.7 | $0.779 | 0/2 | 584.1s |
| #104 | Gemini 3.1 Flash Lite Preview low | 1 | 3.0 | $0.646 | 0/2 | 160.6s | |
| #105 | Gemini 3.1 Flash Lite low | 1 | 3.2 | $0.621 | 0/2 | 161.2s | |
| #110 | Gemma 4 31B medium | 1 | 2.9 | $0.163 | 0/2 | 433.1s | |
| #117 | GPT-5.6 Luna low | OpenAI | 1 | 2.8 | $0.249 | 0/2 | 13.7s |
| #118 | Gemini 2.5 Flash none | 1 | 3.0 | $0.017 | 0/2 | 61.2s | |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 3.8 | $0.837 | 0/2 | 512.8s |
| #123 | Inkling low | Thinkingmachines | 2 | 2.9 | $0.187 | 0/2 | 22.7s |
| #124 | Qwen3.6 Flash none | Qwen | 2 | 3.8 | $0.062 | 0/2 | 26.5s |
| #125 | Qwen3.5-Flash none | Qwen | 1 | 2.9 | $0.073 | 0/2 | 243.6s |