निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #115 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 2/2 | 2.53s |
| #114 | GLM 5.3 high | Z.ai | 9.8 | 7.3 | $0.403 | 2/2 | 3.62s |
| #157 | LongCat 2.0 low | Meituan | 6.5 | 6.7 | $0.412 | 1/2 | 6.39s |
| #76 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 2/2 | 7.54s |
| #96 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 2/2 | 1.48s |
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 2/2 | 3.82s | |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 2/2 | 2.73s |
| #111 | Grok 4.6 low | X AI | 9.8 | 7.4 | $0.449 | 2/2 | 6.64s |
| #33 | Gemini 3.5 Flash low | 9.9 | 8.8 | $0.449 | 2/2 | 1.86s | |
| #159 | GLM 5V Turbo medium | Z.ai | 9.9 | 6.7 | $0.457 | 2/2 | 3.74s |
| #99 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 2/2 | 31.9s |
| #63 | Muse Glimmer 30B xhigh | Meta | 8.4 | 8.1 | $0.471 | 1/2 | 8.90s |
| #88 | DeepSeek V4 Pro high | DeepSeek | 7.8 | 7.7 | $0.476 | 1/2 | 8.73s |
| #140 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 9.9 | 6.9 | $0.478 | 2/2 | 2.58s |
| #139 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.479 | 2/2 | 92.5s |