निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #147 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.041 | 2/2 | 1.48s |
| #155 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 2/2 | 1.50s |
| #159 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.015 | 2/2 | 16.0s |
| #179 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #192 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 2/2 | 4.30s |
| #204 | Laguna Xs.2 medium | Poolside | 10.0 | 4.1 | $0.015 | 2/2 | 1.68s |