Samanya Buddhimatta: निर्देशों का पालन नहीं किया
Samanya Buddhimatta
निर्देशों का पालन नहीं किया
देखें कि Samanya Buddhimatta में किन AI मॉडलों में निर्देशों का पालन नहीं किया आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: कुल लागत ↓.
विफलता के कारण
78/78
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देशों का पालन नहीं किया संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 1 | 5.8 | $5.599 | 0/1 | 6.40s |
| #143 | Gemini 3.1 Flash Lite high | 1 | 5.0 | $2.044 | 0/1 | 45.7s | |
| #12 | Grok 4.5 high | X AI | 1 | 4.7 | $1.707 | 0/1 | 9.82s |
| #58 | Qwen3.5-27B medium | Qwen | 1 | 6.1 | $1.627 | 0/1 | 101.4s |
| #18 | GPT-5.4 medium | OpenAI | 1 | 4.7 | $1.533 | 0/1 | 4.92s |
| #21 | GPT-5.2 medium | OpenAI | 1 | 3.7 | $0.951 | 0/1 | 4.32s |
| #23 | Claude Sonnet 5 medium | Anthropic | 1 | 4.8 | $0.922 | 0/1 | 4.32s |
| #13 | GPT-5.3-Codex medium | OpenAI | 1 | 4.6 | $0.920 | 0/1 | 4.87s |
| #73 | Grok 4.3 medium | X AI | 1 | 5.4 | $0.779 | 0/1 | 24.7s |
| #99 | Qwen3.6 27B medium | Qwen | 1 | 6.5 | $0.779 | 0/1 | 39.5s |
| #75 | Grok 4.20 medium | X AI | 1 | 3.9 | $0.777 | 0/1 | 24.5s |
| #56 | GPT-5.4 Mini medium | OpenAI | 1 | 4.5 | $0.756 | 0/1 | 3.72s |
| #90 | Qwen3.6 35B A3B medium | Qwen | 1 | 4.4 | $0.746 | 0/1 | 8.66s |
| #63 | Claude Sonnet 4.6 none | Anthropic | 1 | 6.1 | $0.661 | 0/1 | 2.56s |
| #104 | Gemini 3.1 Flash Lite Preview low | 1 | 4.0 | $0.646 | 0/1 | 1.54s |