निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: कुल लागत ↓.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #118 | Muse Glimmer 30B high | Meta | 3 | 7.2 | $0.430 | 10/22 | 66.7s |
| #71 | Qwen3.6 Plus medium | Qwen | 1 | 7.8 | $0.418 | 15/22 | 45.5s |
| #152 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.412 | 10/22 | 113.6s |
| #109 | GLM 5.3 high | Z.ai | 1 | 7.3 | $0.403 | 13/22 | 27.8s |
| #50 | Inkling Small high | Thinkingmachines | 2 | 8.4 | $0.398 | 14/22 | 30.4s |
| #209 | GPT-5.4 none | OpenAI | 1 | 5.8 | $0.397 | 7/22 | 2.08s |
| #176 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #284 | MiniMax M2.5 medium | Minimax | 3 | 4.6 | $0.327 | 5/22 | 69.1s |
| #85 | GLM 5 Turbo medium | Z.ai | 1 | 7.6 | $0.323 | 14/21 | 23.0s |
| #92 | MiniMax M3 medium | Minimax | 2 | 7.5 | $0.300 | 11/22 | 75.2s |
| #153 | Gemini 3.5 Flash minimal | 1 | 6.7 | $0.300 | 13/22 | 2.65s | |
| #48 | Qwen3.8 27B high | Qwen | 2 | 8.4 | ~$0.287 | 16/22 | 167.9s |
| #218 | Qwen3.5-122B-A10B none | Qwen | 2 | 5.7 | $0.283 | 6/22 | 12.9s |
| #197 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.280 | 8/22 | 1.66s |
| #72 | Gemini 3.5 Flash Lite medium | 1 | 7.8 | $0.272 | 14/22 | 5.12s |