निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: कुल लागत ↓.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #96 | Mercury 2.5 Preview medium | Inception | 1 | 7.5 | $0.024 | 15/22 | 3.58s |
| #285 | Laguna S 2.1 none | Poolside | 1 | 4.5 | $0.022 | 2/22 | 11.7s |
| #251 | Mistral Small 4 none | Mistral | 1 | 5.1 | $0.022 | 5/22 | 1.20s |
| #232 | Mimo V2 Omni none | Xiaomi | 1 | 5.5 | $0.021 | 8/21 | 2.44s |
| #256 | Qwen3.5-9B none | Qwen | 2 | 5.1 | $0.021 | 4/22 | 19.2s |
| #310 | Step 3.5 Flash none | Stepfun | 1 | 2.3 | $0.020 | 6/12 | 39.0s |
| #184 | gpt-oss-120b medium | OpenAI | 3 | 6.1 | $0.020 | 9/22 | 20.8s |
| #185 | Qwen3.7 Flash none | Qwen | 1 | 6.1 | $0.019 | 7/22 | 10.1s |
| #265 | Mercury 2.5 Preview none | Inception | 1 | 4.9 | $0.018 | 4/22 | 3.51s |
| #191 | Gemma 4 31B none | 1 | 6.1 | $0.016 | 9/22 | 5.41s | |
| #275 | GLM 4.7 Flash none | Z.ai | 1 | 4.8 | $0.016 | 5/22 | 8.81s |
| #244 | Ling-2.6-1T none | Inclusionai | 2 | 5.3 | $0.016 | 4/22 | 8.59s |
| #206 | GLM 5.3 Flash low | Z.ai | 2 | 5.9 | $0.015 | 10/22 | 9.65s |
| #223 | Gemma 4 26B A4B none | 2 | 5.6 | $0.015 | 9/22 | 7.58s | |
| #253 | Granite 4.2 8B low | IBM Granite | 1 | 5.1 | $0.012 | 7/22 | 54.4s |