حيل مضادة للذكاء الاصطناعي: لم يتبع التعليمات
حيل مضادة للذكاء الاصطناعي
لم يتبع التعليمات
اكتشف أي نماذج الذكاء الاصطناعي هي الأكثر عرضة لظهور لم يتبع التعليمات في حيل مضادة للذكاء الاصطناعي، حتى ترصد نقاط الضعف بسرعة أكبر. الترتيب حسب: إجمالي التكلفة ↓.
32/32
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد لم يتبع التعليمات | درجة الفئة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #27 | Muse Spark 1.1 high | Meta | 1 | 7.5 | $1.694 | 2/4 | 8.60s |
| #68 | Kimi K2.6 medium | Moonshot AI | 1 | 7.0 | $1.036 | 2/4 | 11.6s |
| #21 | GPT-5.2 medium | OpenAI | 1 | 6.5 | $0.951 | 2/4 | 7.81s |
| #54 | GPT-5.3 Chat none | OpenAI | 1 | 6.7 | $0.571 | 2/4 | 3.86s |
| #29 | Step 3.7 Flash medium | Stepfun | 1 | 8.7 | $0.515 | 3/4 | 9.65s |
| #97 | LongCat 2.0 high | Meituan | 1 | 8.9 | $0.469 | 3/4 | 7.76s |
| #93 | GLM 5V Turbo medium | Z.ai | 1 | 7.2 | $0.457 | 2/4 | 10.8s |
| #190 | MiniMax M2.5 medium | Minimax | 1 | 7.9 | $0.340 | 2/4 | 20.8s |
| #47 | MiniMax M3 medium | Minimax | 1 | 5.5 | $0.286 | 1/4 | 14.9s |
| #26 | GPT-5 Mini medium | OpenAI | 1 | 7.1 | $0.237 | 2/4 | 13.9s |
| #194 | GLM 4.7 Flash medium | Z.ai | 1 | 4.7 | $0.166 | 1/4 | 15.0s |
| #172 | MiniMax M2.7 medium | Minimax | 1 | 7.9 | $0.163 | 2/4 | 40.3s |
| #65 | Gemini 3.1 Flash Lite medium | 1 | 9.1 | $0.117 | 3/4 | 2.39s | |
| #64 | Gemini 3.1 Flash Lite Preview medium | 1 | 9.1 | $0.115 | 3/4 | 2.33s | |
| #82 | DeepSeek V4 Pro none | DeepSeek | 1 | 3.2 | $0.096 | 0/4 | 4.02s |