অবৈধ টুল কল ব্যর্থতা
দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি অবৈধ টুল কল সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন। সাজান: সঠিক টেস্ট ↑.
138/138
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | অবৈধ টুল কল সংখ্যা | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #166 | GLM 5.3 low | Z.ai | 1 | 6.8 | $0.167 | 12/22 | 13.6s |
| #183 | Qwen3.6 35B A3B medium | Qwen | 1 | 6.6 | $0.750 | 12/22 | 58.5s |
| #184 | Mercury 2.5 Preview high | Inception | 1 | 6.6 | $0.030 | 12/22 | 4.01s |
| #196 | Ling-3.0-flash high | Inclusionai | 2 | 6.4 | $0.021 | 12/22 | 13.7s |
| #65 | Muse Spark 1.1 low | Meta | 1 | 8.3 | $0.673 | 13/22 | 11.9s |
| #72 | Muse Glimmer 30B xhigh | Meta | 1 | 8.1 | $0.510 | 13/22 | 95.6s |
| #84 | Step 3.7 Flash medium | Stepfun | 1 | 7.9 | $0.495 | 13/22 | 23.5s |
| #95 | Qwen3.7 Flash high | Qwen | 1 | 7.8 | $0.052 | 13/22 | 41.4s |
| #100 | DeepSeek V4 Flash 0423 high | DeepSeek | 1 | 7.6 | $0.026 | 13/22 | 51.8s |
| #104 | Nemotron 3 Ultra medium | NVIDIA | 1 | 7.6 | $0.567 | 13/22 | 33.6s |
| #108 | GPT-5.6 Terra low | OpenAI | 1 | 7.5 | $0.420 | 13/22 | 5.45s |
| #109 | Grok 4.7 high | X AI | 1 | 7.5 | $2.180 | 13/22 | 113.1s |
| #113 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |
| #129 | GLM 5.3 Flash high | Z.ai | 1 | 7.3 | $0.029 | 13/22 | 25.4s |
| #130 | Gemini 3.1 Flash Lite medium | 1 | 7.3 | $0.120 | 13/22 | 4.38s |