निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #122 | KAT-Coder-Pro V2.5 high | Kwaipilot | 9.9 | 7.2 | $0.506 | 2/2 | 2.67s |
| #140 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 9.9 | 6.9 | $0.478 | 2/2 | 2.58s |
| #152 | MiMo-V2.5-Pro medium | Xiaomi | 9.9 | 6.8 | $0.221 | 2/2 | 2.77s |
| #159 | GLM 5V Turbo medium | Z.ai | 9.9 | 6.7 | $0.457 | 2/2 | 3.74s |
| #178 | MiMo-V2.5 medium | Xiaomi | 9.9 | 6.4 | $0.104 | 2/2 | 1.80s |
| #181 | Mimo V2 PRO medium | Xiaomi | 9.9 | 6.3 | $0.333 | 2/2 | 3.36s |
| #189 | gpt-oss-120b medium | OpenAI | 9.9 | 6.1 | $0.020 | 2/2 | 7.63s |
| #219 | Inkling Small low | Thinkingmachines | 9.9 | 5.7 | $0.055 | 2/2 | 1.89s |
| #279 | KAT-Coder-Air V2.5 none | Kwaipilot | 9.9 | 4.8 | $0.070 | 2/2 | 1.75s |
| #282 | Hunter Alpha medium | OpenRouter | 9.9 | 4.7 | $0.000 | 2/2 | 4.18s |
| #34 | Muse Spark 1.3 medium | Meta | 9.8 | 8.8 | $1.469 | 2/2 | 10.5s |
| #38 | Gemini 3.6 Flash low | 9.8 | 8.7 | $0.251 | 2/2 | 2.82s | |
| #39 | GLM 5.3 Flash max | Z.ai | 9.8 | 8.7 | $0.059 | 2/2 | 3.65s |
| #55 | Inkling Small high | Thinkingmachines | 9.8 | 8.4 | $0.398 | 2/2 | 3.94s |
| #64 | Inkling high | Thinkingmachines | 9.8 | 8.0 | $1.046 | 2/2 | 7.00s |