निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: कुल लागत ↓.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #237 | MiMo-V2.5-Pro none | Xiaomi | 4 | 5.4 | $0.068 | 5/22 | 4.24s |
| #137 | Qwen3.7 Flash medium | Qwen | 3 | 6.9 | $0.065 | 10/22 | 47.4s |
| #304 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.062 | 3/22 | 107.5s |
| #190 | Qwen3.6 Flash none | Qwen | 1 | 6.1 | $0.062 | 7/22 | 3.73s |
| #34 | GLM 5.3 Flash max | Z.ai | 1 | 8.7 | $0.059 | 16/22 | 52.1s |
| #158 | Qwen3.5-27B none | Qwen | 2 | 6.6 | $0.058 | 9/22 | 4.77s |
| #76 | Qwen3.8 27B medium | Qwen | 2 | 7.8 | ~$0.058 | 14/22 | 33.0s |
| #214 | Inkling Small low | Thinkingmachines | 2 | 5.7 | $0.055 | 9/22 | 2.07s |
| #262 | DeepSeek V3.2 none | DeepSeek | 1 | 5.0 | $0.054 | 6/22 | 17.9s |
| #241 | Inkling Small none | Thinkingmachines | 1 | 5.3 | $0.054 | 5/22 | 1.51s |
| #234 | Laguna S 2.1 medium | Poolside | 1 | 5.4 | $0.053 | 4/22 | 58.4s |
| #79 | Qwen3.7 Flash high | Qwen | 1 | 7.8 | $0.052 | 13/22 | 41.4s |
| #221 | GLM 5V Turbo none | Z.ai | 2 | 5.6 | $0.052 | 8/21 | 2.99s |
| #168 | Gemini 3.1 Flash Lite Preview none | 2 | 6.4 | $0.052 | 12/22 | 1.56s | |
| #180 | GPT-5.6 Luna low | OpenAI | 1 | 6.2 | $0.051 | 10/22 | 5.20s |