حيل مضادة للذكاء الاصطناعي: إجابة خاطئة
حيل مضادة للذكاء الاصطناعي
إجابة خاطئة
اكتشف أي نماذج الذكاء الاصطناعي هي الأكثر عرضة لظهور إجابة خاطئة في حيل مضادة للذكاء الاصطناعي، حتى ترصد نقاط الضعف بسرعة أكبر.
أسباب الفشل
188/188
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد إجابة خاطئة | درجة الفئة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #159 | GLM 5V Turbo medium | Z.ai | 1 | 7.2 | $0.457 | 2/4 | 10.8s |
| #161 | Claude Opus 4.7 none | Anthropic | 1 | 8.3 | $0.505 | 3/4 | 2.12s |
| #164 | Gemini 3.1 Flash Lite Preview low | 1 | 8.3 | $0.646 | 3/4 | 2.12s | |
| #170 | Qwen3.6 27B medium | Qwen | 1 | 8.3 | $0.577 | 3/4 | 12.6s |
| #173 | Gemini 3.1 Flash Lite Preview none | 1 | 7.5 | $0.052 | 2/4 | 1.04s | |
| #176 | Dots 3 Note Preview high | Dots Studio | 1 | 8.7 | $0.000 | 3/4 | 6.97s |
| #185 | GPT-5.6 Luna low | OpenAI | 1 | 8.3 | $0.051 | 3/4 | 2.21s |
| #186 | Claude Sonnet 5 none | Anthropic | 1 | 5.3 | $0.548 | 1/4 | 3.60s |
| #187 | Gemini 3.1 Flash Lite minimal | 1 | 8.3 | $0.047 | 3/4 | 1.10s | |
| #189 | gpt-oss-120b medium | OpenAI | 1 | 6.7 | $0.020 | 2/4 | 10.2s |
| #193 | Inkling low | Thinkingmachines | 1 | 8.3 | $0.187 | 3/4 | 2.51s |
| #199 | Trinity Large Thinking low | Arcee AI | 1 | 8.3 | $0.625 | 3/4 | 5.70s |
| #201 | Grok 4.20 Beta medium | X AI | 1 | 8.7 | $0.750 | 3/4 | 3.16s |
| #208 | Dots 3 Note Preview medium | Dots Studio | 1 | 8.7 | $0.000 | 3/4 | 7.76s |
| #211 | GLM 5.3 Flash low | Z.ai | 1 | 8.7 | $0.015 | 3/4 | 2.14s |