Samanya Buddhimatta: निर्देशों का पालन नहीं किया
Samanya Buddhimatta
निर्देशों का पालन नहीं किया
देखें कि Samanya Buddhimatta में किन AI मॉडलों में निर्देशों का पालन नहीं किया आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
115/115
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #71 | Qwen3.6 Plus medium | Qwen | 1 | 5.1 | $0.418 | 0/1 | 27.1s |
| #72 | Gemini 3.5 Flash Lite medium | 1 | 4.7 | $0.272 | 0/1 | 2.97s | |
| #76 | Qwen3.8 27B medium | Qwen | 1 | 5.0 | ~$0.058 | 0/1 | 9.20s |
| #77 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 6.7 | $0.236 | 0/1 | 18.2s |
| #80 | GLM 5 medium | Z.ai | 1 | 6.1 | $0.228 | 0/1 | 14.7s |
| #81 | Seed-2.0-Code low | Bytedance Seed | 1 | 6.5 | $0.767 | 0/1 | 11.1s |
| #84 | DeepSeek V4 Flash 0423 high | DeepSeek | 1 | 6.1 | $0.039 | 0/1 | 25.2s |
| #87 | Solar Pro 4 xhigh | Upstage | 1 | 5.5 | $0.050 | 0/1 | 61.9s |
| #90 | GPT-5.4 Nano medium | OpenAI | 1 | 4.5 | $0.142 | 0/1 | 4.15s |
| #92 | MiniMax M3 medium | Minimax | 1 | 5.1 | $0.300 | 0/1 | 33.3s |
| #93 | GPT 5.3 Chat none | OpenAI | 1 | 4.6 | $0.533 | 0/1 | 1.99s |
| #95 | Qwen3.5-27B medium | Qwen | 1 | 6.1 | $0.982 | 0/1 | 101.4s |
| #96 | Mercury 2.5 Preview medium | Inception | 1 | 5.0 | $0.024 | 0/1 | 2.09s |
| #97 | GPT-5.4 Mini medium | OpenAI | 1 | 4.5 | $0.786 | 0/1 | 3.72s |
| #105 | Qwen3.8 2.4T A95B high | Qwen | 1 | 6.1 | $2.357 | 0/1 | 11.4s |