निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #280 | GLM 4.7 Flash none | Z.ai | 6.5 | 4.8 | $0.016 | 1/2 | 888ms |
| #283 | Grok 4.1 Fast medium | X AI | 6.5 | 4.7 | $0.069 | 1/2 | 4.63s |
| #286 | Mercury 2 none | Inception | 6.5 | 4.7 | $0.030 | 1/2 | 551ms |
| #287 | Granite 4.2 8B high | IBM Granite | 6.4 | 4.6 | $0.084 | 1/2 | 87.5s |
| #288 | Qwen3 Coder Next medium | Qwen | 6.3 | 4.6 | $0.034 | 1/2 | 7.49s |
| #289 | MiniMax M2.5 medium | Minimax | 7.5 | 4.6 | $0.327 | 1/2 | 621ms |
| #291 | Grok 4.20 Beta none | X AI | 6.3 | 4.4 | $0.087 | 1/2 | 649ms |
| #292 | Laguna M.1 none | Poolside | 6.3 | 4.4 | $0.009 | 1/2 | 683ms |
| #294 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #297 | Hunter Alpha none | OpenRouter | 6.4 | 4.2 | $0.000 | 1/2 | 2.82s |
| #298 | Grok 4.20 none | X AI | 6.3 | 4.1 | $0.057 | 1/2 | 445ms |
| #300 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.007 | 1/2 | 13.0s |
| #301 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 6.5 | 4.0 | $0.007 | 1/2 | 511ms |
| #306 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |