استدعاء الأدوات: إجابة خاطئة
استدعاء الأدوات
إجابة خاطئة
اكتشف أي نماذج الذكاء الاصطناعي هي الأكثر عرضة لظهور إجابة خاطئة في استدعاء الأدوات، حتى ترصد نقاط الضعف بسرعة أكبر. الترتيب حسب: زمن الاستجابة (المتوسط) ↓.
3/3
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد إجابة خاطئة | درجة الفئة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #176 | GLM 4.7 Flash none | Z.ai | 1 | 2.8 | $0.016 | 0/1 | 7.05s |
| #55 | GPT-5.6 Terra low | OpenAI | 1 | 4.7 | $0.519 | 0/1 | 6.69s |
| #203 | Grok 4.1 Fast none | X AI | 1 | 2.8 | $0.008 | 0/1 | 5.51s |