निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #288 | Qwen3 Coder Next medium | Qwen | 6.3 | 4.6 | $0.034 | 1/2 | 7.49s |
| #291 | Grok 4.20 Beta none | X AI | 6.3 | 4.4 | $0.087 | 1/2 | 649ms |
| #298 | Grok 4.20 none | X AI | 6.3 | 4.1 | $0.057 | 1/2 | 445ms |
| #316 | LFM2-24B-A2B none | Liquid | 6.3 | 2.2 | $0.001 | 1/2 | 752ms |
| #234 | Qwen3.6 27B none | Qwen | 6.2 | 5.5 | $0.062 | 1/2 | 1.92s |
| #135 | GPT-5.5 none | OpenAI | 6.2 | 7.0 | $0.544 | 1/2 | 1.15s |
| #197 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.2 | 6.1 | $0.122 | 1/2 | 1.17s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #251 | Qwen3.6 35B A3B none | Qwen | 6.2 | 5.3 | $0.051 | 1/2 | 1.86s |
| #294 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #142 | Qwen3.7 Flash medium | Qwen | 5.8 | 6.9 | $0.065 | 0/2 | 9.27s |
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 5.0 | 5.4 | $0.011 | 0/2 | 1.42s |
| #315 | Step 3.5 Flash none | Stepfun | 5.0 | 2.3 | $0.020 | 1/1 | 9.30s |
| #220 | Ling-3.0-flash none | Inclusionai | 4.8 | 5.7 | $0.004 | 0/2 | 836ms |
| #252 | Dots 3 Note Preview none | Dots Studio | 4.8 | 5.2 | $0.000 | 0/2 | 1.06s |