निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: स्कोर ↑.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #206 | GLM 5.3 Flash low | Z.ai | 2 | 5.9 | $0.015 | 10/22 | 9.65s |
| #204 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 2 | 5.9 | $0.000 | 8/22 | 67.1s |
| #202 | Step 3.5 Flash medium | Stepfun | 3 | 5.9 | $0.132 | 10/21 | 191.6s |
| #201 | Qwen3.5-35B-A3B none | Qwen | 2 | 5.9 | $0.142 | 6/22 | 12.7s |
| #199 | GPT-5 Nano medium | OpenAI | 2 | 6.0 | $0.118 | 8/22 | 54.2s |
| #197 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.280 | 8/22 | 1.66s |
| #196 | Grok 4.20 Beta medium | X AI | 1 | 6.0 | $0.750 | 14/18 | 9.75s |
| #194 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |
| #193 | Nemotron 3 Ultra none | NVIDIA | 1 | 6.1 | $0.084 | 8/22 | 3.88s |
| #192 | Qwen3.5 Plus 2026-04-20 none | Qwen | 2 | 6.1 | $0.122 | 8/22 | 13.1s |
| #191 | Gemma 4 31B none | 1 | 6.1 | $0.016 | 9/22 | 5.41s | |
| #190 | Qwen3.6 Flash none | Qwen | 1 | 6.1 | $0.062 | 7/22 | 3.73s |
| #189 | Trinity Large Thinking medium | Arcee AI | 4 | 6.1 | $0.756 | 8/22 | 85.4s |
| #188 | Inkling low | Thinkingmachines | 2 | 6.1 | $0.187 | 10/22 | 5.11s |