निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #46 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 2/2 | 7.25s |
| #39 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 2/2 | 7.26s |
| #208 | Grok Build 0.1 none | X AI | 9.8 | 4.0 | $0.547 | 2/2 | 7.36s |
| #64 | LongCat 2.0 medium | Meituan | 6.5 | 7.4 | $0.478 | 1/2 | 7.38s |
| #11 | Qwen3.7 Max medium | Qwen | 10.0 | 9.2 | $1.116 | 2/2 | 7.46s |
| #78 | GLM 5.1 medium | Z.ai | 6.4 | 7.1 | $0.535 | 1/2 | 7.47s |
| #193 | Qwen3 Coder Next medium | Qwen | 6.3 | 4.7 | $0.032 | 1/2 | 7.49s |
| #94 | Qwen3.6 35B A3B medium | Qwen | 10.0 | 6.7 | $0.746 | 2/2 | 7.50s |
| #41 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 2/2 | 7.54s |
| #127 | gpt-oss-120b medium | OpenAI | 9.9 | 6.1 | $0.019 | 2/2 | 7.63s |
| #37 | Kimi K3 max | Moonshot AI | 10.0 | 8.0 | $3.112 | 2/2 | 7.66s |
| #172 | Qwen3 Coder Next none | Qwen | 6.3 | 5.1 | $0.025 | 1/2 | 7.78s |
| #30 | Muse Spark 1.1 high | Meta | 6.4 | 8.1 | $1.694 | 1/2 | 7.81s |
| #42 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.187 | 2/2 | 7.90s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 7.8 | 7.7 | $0.200 | 1/2 | 8.73s |