टूल कॉलिंग: गलत उत्तर
टूल कॉलिंग
गलत उत्तर
देखें कि टूल कॉलिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: कुल लागत ↑.
3/3
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #203 | Grok 4.1 Fast none | X AI | 1 | 2.8 | $0.008 | 0/1 | 5.51s |
| #176 | GLM 4.7 Flash none | Z.ai | 1 | 2.8 | $0.016 | 0/1 | 7.05s |
| #55 | GPT-5.6 Terra low | OpenAI | 1 | 4.7 | $0.519 | 0/1 | 6.69s |