إخفاقات استدعاء أداة غير صالح
اكتشف أي نماذج الذكاء الاصطناعي تواجه استدعاء أداة غير صالح أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: اختبارات صحيحة ↓.
131/131
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد استدعاء أداة غير صالح | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #265 | Mercury 2.5 Preview none | Inception | 1 | 4.9 | $0.018 | 4/22 | 3.51s |
| #282 | Granite 4.2 8B high | IBM Granite | 1 | 4.6 | $0.084 | 4/22 | 235.9s |
| #289 | GLM 4.7 Flash medium | Z.ai | 2 | 4.3 | $0.168 | 4/22 | 134.3s |
| #301 | Ling 3.0 Tiny high | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 75.7s |
| #302 | Ling 3.0 Tiny low | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 66.2s |
| #305 | Ling 3.0 Tiny medium | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 68.1s |
| #247 | Dots 3 Note Preview none | Dots Studio | 1 | 5.2 | $0.000 | 3/22 | 3.53s |
| #261 | Laguna S 2.1 low | Poolside | 1 | 5.0 | $0.082 | 3/22 | 85.3s |
| #299 | Nemotron 3.5 Lightning none | NVIDIA | 2 | 4.0 | $0.007 | 3/22 | 1.21s |
| #297 | Ling 3.0 Tiny none | Inclusionai | 1 | 4.0 | $0.000 | 2/22 | 14.0s |
| #298 | Granite 4.1 8B none | IBM Granite | 2 | 4.0 | $0.007 | 2/22 | 1.44s |