إخفاقات إجابة خاطئة
اكتشف أي نماذج الذكاء الاصطناعي تواجه إجابة خاطئة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: إجمالي التكلفة ↓.
215/215
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد إجابة خاطئة | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #199 | Elephant Alpha none | Openrouter | 9 | 4.3 | $0.000 | 5/21 | 1.22s |
| #201 | Elephant Alpha medium | Openrouter | 9 | 4.3 | $0.000 | 6/21 | 1.27s |
| #202 | Hunter Alpha none | OpenRouter | 9 | 4.2 | $0.000 | 6/18 | 4.70s |
| #213 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7 | 3.4 | $0.000 | 4/19 | 17.1s |
| #214 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 9 | 3.2 | $0.000 | 2/19 | 728ms |