निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #134 | GLM 5.1 medium | Z.ai | 6.4 | 7.0 | $0.727 | 1/2 | 7.47s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 9.8 | 8.4 | $1.951 | 2/2 | 7.48s |
| #288 | Qwen3 Coder Next medium | Qwen | 6.3 | 4.6 | $0.034 | 1/2 | 7.49s |
| #167 | Qwen3.6 35B A3B medium | Qwen | 10.0 | 6.6 | $0.672 | 2/2 | 7.50s |
| #76 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 2/2 | 7.54s |
| #189 | gpt-oss-120b medium | OpenAI | 9.9 | 6.1 | $0.020 | 2/2 | 7.63s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 9.8 | 8.9 | $1.797 | 2/2 | 7.66s |
| #71 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $3.467 | 2/2 | 7.66s |
| #208 | Dots 3 Note Preview medium | Dots Studio | 8.5 | 5.9 | $0.000 | 1/2 | 7.77s |
| #259 | Qwen3 Coder Next none | Qwen | 6.3 | 5.1 | $0.026 | 1/2 | 7.78s |
| #176 | Dots 3 Note Preview high | Dots Studio | 8.3 | 6.4 | $0.000 | 1/2 | 7.80s |
| #65 | Muse Spark 1.1 high | Meta | 6.4 | 8.0 | $2.253 | 1/2 | 7.81s |
| #175 | Dots 3 Note Preview low | Dots Studio | 7.9 | 6.4 | $0.000 | 1/2 | 7.83s |
| #78 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.224 | 2/2 | 7.90s |
| #53 | Qwen3.8 27B high | Qwen | 9.8 | 8.4 | ~$0.287 | 2/2 | 8.24s |