निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: कुल लागत ↑.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #187 | Qwen3.5-Flash medium | Qwen | 1 | 6.1 | $0.142 | 11/22 | 84.4s |
| #90 | GPT-5.4 Nano medium | OpenAI | 2 | 7.5 | $0.142 | 12/22 | 13.3s |
| #201 | Qwen3.5-35B-A3B none | Qwen | 2 | 5.9 | $0.142 | 6/22 | 12.7s |
| #248 | Inkling none | Thinkingmachines | 1 | 5.2 | $0.147 | 6/22 | 3.47s |
| #243 | Seed-2.0-Code none | Bytedance Seed | 2 | 5.3 | $0.151 | 6/22 | 14.7s |
| #123 | Muse Glimmer 30B low | Meta | 3 | 7.1 | $0.152 | 11/22 | 18.6s |
| #150 | GLM 5.2 none | Z.ai | 1 | 6.7 | $0.153 | 13/22 | 9.65s |
| #250 | Nemotron 3.5 Lightning medium | NVIDIA | 3 | 5.1 | $0.156 | 5/22 | 70.1s |
| #289 | GLM 4.7 Flash medium | Z.ai | 2 | 4.3 | $0.168 | 4/22 | 134.3s |
| #188 | Inkling low | Thinkingmachines | 2 | 6.1 | $0.187 | 10/22 | 5.11s |
| #127 | GPT-5.6 Sol none | OpenAI | 1 | 7.0 | $0.201 | 12/22 | 2.17s |
| #259 | MiniMax M2.7 medium | Minimax | 5 | 5.0 | $0.208 | 5/22 | 43.2s |
| #147 | MiMo-V2.5-Pro medium | Xiaomi | 2 | 6.8 | $0.221 | 11/22 | 48.7s |
| #145 | DeepSeek V4 Pro none | DeepSeek | 2 | 6.8 | $0.226 | 9/22 | 11.7s |
| #121 | Muse Glimmer 30B medium | Meta | 1 | 7.2 | $0.227 | 11/22 | 30.6s |