टूल कॉलिंग: गलत उत्तर
टूल कॉलिंग
गलत उत्तर
देखें कि टूल कॉलिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: कुल लागत ↓.
3/3
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #55 | GPT-5.6 Terra low | OpenAI | 1 | 4.7 | $0.519 | 0/1 | 6.69s |
| #176 | GLM 4.7 Flash none | Z.ai | 1 | 2.8 | $0.016 | 0/1 | 7.05s |
| #203 | Grok 4.1 Fast none | X AI | 1 | 2.8 | $0.008 | 0/1 | 5.51s |