निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें।
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #251 | Mistral Small 4 none | Mistral | 1 | 5.1 | $0.022 | 5/22 | 1.20s |
| #253 | Granite 4.2 8B low | IBM Granite | 1 | 5.1 | $0.012 | 7/22 | 54.4s |
| #254 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.026 | 5/22 | 8.63s |
| #255 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.68s |
| #261 | Laguna S 2.1 low | Poolside | 1 | 5.0 | $0.082 | 3/22 | 85.3s |
| #262 | DeepSeek V3.2 none | DeepSeek | 1 | 5.0 | $0.054 | 6/22 | 17.9s |
| #263 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #265 | Mercury 2.5 Preview none | Inception | 1 | 4.9 | $0.018 | 4/22 | 3.51s |
| #275 | GLM 4.7 Flash none | Z.ai | 1 | 4.8 | $0.016 | 5/22 | 8.81s |
| #279 | Laguna M.1 medium | Poolside | 1 | 4.7 | $0.033 | 9/19 | 14.7s |
| #281 | Mercury 2 none | Inception | 1 | 4.7 | $0.030 | 4/22 | 825ms |
| #285 | Laguna S 2.1 none | Poolside | 1 | 4.5 | $0.022 | 2/22 | 11.7s |
| #286 | Grok 4.20 Beta none | X AI | 1 | 4.4 | $0.087 | 6/18 | 1.19s |
| #291 | Granite 4.2 8B none | IBM Granite | 1 | 4.3 | $0.026 | 3/22 | 86.3s |
| #299 | Nemotron 3.5 Lightning none | NVIDIA | 1 | 4.0 | $0.007 | 3/22 | 1.21s |