संयुक्त: अमान्य टूल कॉल
संयुक्त
अमान्य टूल कॉल
देखें कि संयुक्त में किन AI मॉडलों में अमान्य टूल कॉल आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↓.
विफलता के कारण
श्रेणियाँ
77/77
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | अमान्य टूल कॉल संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #2 | Gemini 3.5 Flash high | 1 | 8.2 | $1.976 | 1/2 | 84.1s | |
| #8 | Qwen3.7 Max medium | Qwen | 1 | 8.7 | $1.116 | 1/2 | 287.8s |
| #11 | Gemini 3.5 Flash low | 1 | 8.2 | $0.433 | 1/2 | 30.0s | |
| #16 | Muse Spark 1.1 medium | Meta | 1 | 8.3 | $1.357 | 1/2 | 42.6s |
| #17 | Claude Fable 5 medium | Anthropic | 1 | 6.5 | $3.478 | 1/2 | 27.5s |
| #23 | Claude Sonnet 5 medium | Anthropic | 1 | 7.3 | $0.922 | 1/2 | 51.9s |
| #24 | Muse Spark 1.1 low | Meta | 1 | 6.6 | $0.647 | 1/2 | 29.4s |
| #28 | Inkling high | Thinkingmachines | 1 | 7.3 | $1.006 | 1/2 | 63.8s |
| #29 | Step 3.7 Flash medium | Stepfun | 1 | 7.3 | $0.515 | 1/2 | 80.9s |
| #34 | GPT-5.6 Terra high | OpenAI | 1 | 8.7 | $1.055 | 1/2 | 13.7s |
| #36 | Qwen3.7 Plus medium | Qwen | 1 | 8.2 | $0.267 | 1/2 | 190.3s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 1 | 6.4 | $0.042 | 1/2 | 104.1s |
| #51 | Nemotron 3 Ultra medium | NVIDIA | 1 | 6.3 | $0.774 | 1/2 | 218.2s |
| #55 | GPT-5.6 Terra low | OpenAI | 1 | 8.7 | $0.519 | 1/2 | 9.68s |
| #56 | GPT-5.4 Mini medium | OpenAI | 1 | 6.9 | $0.756 | 1/2 | 59.6s |