निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: स्कोर ↓.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #21 | Gemini 3.5 Flash medium | 1 | 9.0 | $0.665 | 18/22 | 8.48s | |
| #24 | Grok 4.5 high | X AI | 1 | 9.0 | $2.252 | 17/22 | 72.3s |
| #25 | GPT-5.3-Codex medium | OpenAI | 2 | 8.9 | $0.988 | 16/22 | 16.9s |
| #26 | Muse Spark 1.3 high | Meta | 2 | 8.9 | $1.653 | 16/22 | 52.5s |
| #27 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 8.9 | $1.797 | 16/22 | 174.0s |
| #34 | GLM 5.3 Flash max | Z.ai | 1 | 8.7 | $0.059 | 16/22 | 52.1s |
| #36 | Muse Spark 1.2 high | Meta | 3 | 8.7 | $1.771 | 14/22 | 26.6s |
| #37 | Muse Spark 1.2 medium | Meta | 3 | 8.6 | $1.339 | 14/22 | 19.7s |
| #38 | Muse Spark 1.1 medium | Meta | 2 | 8.6 | $1.420 | 15/22 | 26.2s |
| #41 | Qwen3.8 Max low | Qwen | 1 | 8.6 | $0.702 | 16/22 | 21.8s |
| #42 | GPT-5.4 medium | OpenAI | 2 | 8.5 | $1.560 | 15/22 | 22.9s |
| #44 | Muse Spark 1.2 low | Meta | 3 | 8.4 | $0.655 | 15/22 | 9.77s |
| #45 | Grok 4.6 medium | X AI | 1 | 8.4 | $1.713 | 16/22 | 73.5s |
| #47 | GPT-5.2 medium | OpenAI | 3 | 8.4 | $1.182 | 14/22 | 28.5s |
| #48 | Qwen3.8 27B high | Qwen | 2 | 8.4 | ~$0.287 | 16/22 | 167.9s |