निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #60 | Claude Sonnet 5 medium | Anthropic | 9.9 | 8.2 | $0.922 | 2/2 | 3.10s |
| #307 | Ling 3.0 Tiny low | Inclusionai | 6.6 | 3.8 | $0.000 | 1/2 | 3.09s |
| #30 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.988 | 2/2 | 3.04s |
| #66 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.9 | 8.0 | $0.044 | 2/2 | 3.01s |
| #310 | Ling 3.0 Tiny medium | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.00s |
| #294 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #49 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 2.95s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 2/2 | 2.86s |
| #196 | Gemma 4 31B none | 6.5 | 6.1 | $0.016 | 1/2 | 2.84s | |
| #297 | Hunter Alpha none | OpenRouter | 6.4 | 4.2 | $0.000 | 1/2 | 2.82s |
| #177 | LongCat 2.0 none | Meituan | 6.5 | 6.4 | $0.044 | 1/2 | 2.82s |
| #38 | Gemini 3.6 Flash low | 9.8 | 8.7 | $0.251 | 2/2 | 2.82s | |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 2/2 | 2.81s | |
| #94 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 2/2 | 2.81s |
| #51 | Grok 4.5 low | X AI | 9.8 | 8.4 | $0.945 | 2/2 | 2.80s |