إخفاقات إجابة خاطئة
اكتشف أي نماذج الذكاء الاصطناعي تواجه إجابة خاطئة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: زمن الاستجابة (المتوسط) ↓.
215/215
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد إجابة خاطئة | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #203 | Grok 4.20 none | X AI | 10 | 4.1 | $0.057 | 6/18 | 1.11s |
| #195 | Mercury 2 none | Inception | 17 | 4.6 | $0.030 | 4/22 | 829ms |
| #211 | Laguna Xs.2 none | Poolside | 8 | 3.8 | $0.004 | 5/19 | 806ms |
| #216 | LFM2-24B-A2B none | Liquid | 9 | 2.2 | $0.001 | 2/16 | 782ms |
| #214 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 9 | 3.2 | $0.000 | 2/19 | 728ms |