निर्देशों का पालन नहीं किया विफलताएँ
देखें कि किन AI मॉडलों में निर्देशों का पालन नहीं किया सबसे अधिक होता है, ताकि आप चुनने से पहले भरोसेमंदी के जोखिम समझ सकें। क्रमबद्ध करें: कुल लागत ↑.
215/215
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #175 | Ring-2.6-1T medium | Inclusionai | 2 | 6.4 | $0.102 | 11/22 | 68.8s |
| #173 | MiMo-V2.5 medium | Xiaomi | 1 | 6.4 | $0.104 | 11/22 | 46.3s |
| #113 | Qwen3.7 Plus none | Qwen | 1 | 7.3 | $0.106 | 12/22 | 12.1s |
| #160 | Inkling Small medium | Thinkingmachines | 4 | 6.6 | $0.113 | 10/22 | 6.30s |
| #240 | Laguna S 2.1 high | Poolside | 1 | 5.4 | $0.114 | 4/22 | 111.6s |
| #229 | Qwen3.6 27B none | Qwen | 2 | 5.5 | $0.116 | 7/22 | 10.6s |
| #133 | Seed-2.0-Mini medium | Bytedance Seed | 1 | 7.0 | $0.116 | 11/22 | 93.1s |
| #100 | Gemini 3.1 Flash Lite Preview medium | 1 | 7.4 | $0.117 | 14/22 | 4.59s | |
| #199 | GPT-5 Nano medium | OpenAI | 2 | 6.0 | $0.118 | 8/22 | 54.2s |
| #112 | Gemini 3.1 Flash Lite medium | 1 | 7.3 | $0.120 | 13/22 | 4.38s | |
| #192 | Qwen3.5 Plus 2026-04-20 none | Qwen | 2 | 6.1 | $0.122 | 8/22 | 13.1s |
| #202 | Step 3.5 Flash medium | Stepfun | 3 | 5.9 | $0.132 | 10/21 | 191.6s |
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 4 | 5.6 | $0.134 | 5/22 | 58.3s |
| #157 | Gemini 3.5 Flash Lite low | 1 | 6.6 | $0.138 | 12/22 | 2.56s | |
| #270 | Nemotron 3.5 Lightning low | NVIDIA | 2 | 4.8 | $0.140 | 5/22 | 59.8s |