অবৈধ টুল কল ব্যর্থতা
দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি অবৈধ টুল কল সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন। সাজান: সঠিক টেস্ট ↑.
138/138
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | অবৈধ টুল কল সংখ্যা | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #311 | Grok 4.20 Beta none | X AI | 1 | 4.4 | $0.087 | 6/18 | 1.19s |
| #318 | Grok 4.20 none | X AI | 1 | 4.1 | $0.057 | 6/18 | 1.11s |
| #212 | Trinity Large Thinking medium | Arcee AI | 2 | 6.1 | $0.756 | 8/22 | 85.4s |
| #217 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |
| #218 | Gemini 2.5 Flash none | 1 | 6.0 | $0.017 | 8/22 | 6.19s | |
| #220 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.280 | 8/22 | 1.66s |
| #234 | North Mini Code medium | Cohere | 1 | 5.7 | $0.000 | 8/22 | 142.0s |
| #239 | GLM 5.1 none | Z.ai | 1 | 5.7 | $0.164 | 8/22 | 6.74s |
| #165 | DeepSeek V4 Pro none | DeepSeek | 1 | 6.8 | $0.202 | 9/22 | 11.7s |
| #187 | Laguna XS 2.1 medium | Poolside | 1 | 6.5 | $0.068 | 9/22 | 48.2s |
| #207 | gpt-oss-120b medium | OpenAI | 1 | 6.1 | $0.070 | 9/22 | 20.8s |
| #237 | Inkling Small low | Thinkingmachines | 2 | 5.7 | $0.055 | 9/22 | 2.07s |
| #246 | Gemma 4 26B A4B none | 1 | 5.6 | $0.017 | 9/22 | 7.58s | |
| #254 | Qwen3.8 27B none | Qwen | 1 | 5.5 | ~$0.006 | 9/22 | 3.12s |
| #150 | Mercury 2 medium | Inception | 1 | 7.0 | $0.094 | 10/22 | 2.95s |