निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #60 | Claude Sonnet 5 medium | Anthropic | 9.9 | 8.2 | $0.922 | 2/2 | 3.10s |
| #306 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |
| #47 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #52 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $1.182 | 2/2 | 3.12s |
| #203 | Gemini 3 PRO Preview medium | 9.8 | 6.0 | $0.385 | 2/2 | 3.26s | |
| #36 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 2/2 | 3.32s |
| #11 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 2/2 | 3.35s | |
| #181 | Mimo V2 PRO medium | Xiaomi | 9.9 | 6.3 | $0.333 | 2/2 | 3.36s |
| #27 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 2/2 | 3.36s |
| #144 | Gemini 3.5 Flash none | 9.8 | 6.9 | $1.093 | 2/2 | 3.38s | |
| #151 | GLM 5.3 low | Z.ai | 10.0 | 6.8 | $0.257 | 2/2 | 3.40s |
| #269 | Qwen3.6 Plus Preview medium | Qwen | 6.5 | 4.9 | $0.000 | 1/2 | 3.40s |
| #28 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 2/2 | 3.49s |
| #98 | GPT 5.3 Chat none | OpenAI | 9.8 | 7.5 | $0.533 | 2/2 | 3.51s |
| #278 | Grok 4.20 Multi Agent Beta medium | X AI | 9.8 | 4.8 | $5.599 | 2/2 | 3.52s |