कोडिंग: निर्देशों का पालन नहीं किया
कोडिंग
निर्देशों का पालन नहीं किया
देखें कि कोडिंग में किन AI मॉडलों में निर्देशों का पालन नहीं किया आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
विफलता के कारण
38/38
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #130 | Mistral Large 4 high | Mistral | 1 | 0.3 | $1.391 | 0/3 | 1277.8s |
| #131 | Seed-2.0-Code high | Bytedance Seed | 1 | 0.6 | $1.448 | 1/3 | 266.7s |
| #77 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 0.6 | $0.576 | 1/3 | 252.7s |
| #56 | Qwen3.8 27B high | Qwen | 1 | 0.8 | ~$0.298 | 2/3 | 248.6s |
| #269 | Trinity Large Thinking high | Arcee AI | 1 | 0.4 | $0.794 | 0/3 | 245.0s |
| #375 | Ling 3.0 Tiny medium | Inclusionai | 1 | 0.3 | $0.000 | 0/3 | 212.0s |
| #160 | Qwen3.8 Flash Next xhigh | Qwen | 1 | 0.7 | ~$0.195 | 2/3 | 192.2s |
| #245 | Trinity Large Thinking medium | Arcee AI | 1 | 0.8 | $0.862 | 2/3 | 179.0s |
| #373 | Ling 3.0 Tiny high | Inclusionai | 1 | 0.3 | $0.000 | 0/3 | 177.7s |
| #374 | Ling 3.0 Tiny low | Inclusionai | 1 | 0.3 | $0.000 | 0/3 | 170.7s |
| #108 | Qwen3.8 2.4T A95B high | Qwen | 1 | 0.6 | $2.949 | 1/3 | 160.5s |
| #231 | Ling 3.1 Flash low | Inclusionai | 1 | 0.6 | $0.000 | 1/3 | 107.3s |
| #365 | Qwen3.5-9B medium | Qwen | 1 | 0.3 | $0.106 | 0/3 | 100.9s |
| #266 | DeepSeek V4.1 Flash none | DeepSeek | 1 | 0.6 | $0.391 | 1/3 | 83.7s |
| #282 | Kimi K2.6 none | Moonshot AI | 1 | 0.6 | $0.486 | 1/3 | 82.6s |