إخفاقات استدعاء أداة غير صالح
اكتشف أي نماذج الذكاء الاصطناعي تواجه استدعاء أداة غير صالح أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: إجمالي التكلفة ↓.
83/83
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد استدعاء أداة غير صالح | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #201 | Granite 4.1 8B none | IBM Granite | 2 | 4.0 | $0.007 | 2/22 | 1.45s |
| #205 | Laguna Xs.2 none | Poolside | 1 | 3.8 | $0.004 | 5/19 | 806ms |
| #178 | Ling-2.6-flash none | Inclusionai | 3 | 4.9 | $0.002 | 6/22 | 10.7s |
| #137 | North Mini Code medium | Cohere | 1 | 5.9 | $0.000 | 9/22 | 137.1s |
| #171 | North Mini Code none | Cohere | 2 | 5.1 | $0.000 | 4/22 | 29.9s |
| #188 | Cobuddy medium | Baidu | 1 | 4.7 | $0.000 | 7/21 | 39.9s |
| #193 | Elephant Alpha none | Openrouter | 1 | 4.3 | $0.000 | 5/21 | 1.22s |
| #195 | Elephant Alpha medium | Openrouter | 1 | 4.3 | $0.000 | 6/21 | 1.27s |