निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #260 | MiMo-V2.5 none | Xiaomi | 6.5 | 5.1 | $0.025 | 1/2 | 751ms |
| #261 | Qwen3.5-9B none | Qwen | 6.5 | 5.1 | $0.021 | 1/2 | 514ms |
| #262 | GLM 5 Turbo none | Z.ai | 6.5 | 5.1 | $0.047 | 1/2 | 2.13s |
| #263 | North Mini Code none | Cohere | 6.5 | 5.1 | $0.000 | 1/2 | 30.7s |
| #269 | Qwen3.6 Plus Preview medium | Qwen | 6.5 | 4.9 | $0.000 | 1/2 | 3.40s |
| #280 | GLM 4.7 Flash none | Z.ai | 6.5 | 4.8 | $0.016 | 1/2 | 888ms |
| #283 | Grok 4.1 Fast medium | X AI | 6.5 | 4.7 | $0.069 | 1/2 | 4.63s |
| #286 | Mercury 2 none | Inception | 6.5 | 4.7 | $0.030 | 1/2 | 551ms |
| #301 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 6.5 | 4.0 | $0.007 | 1/2 | 511ms |
| #309 | Qwen3.5-9B medium | Qwen | 6.5 | 3.8 | $0.062 | 1/2 | 5.75s |
| #311 | Laguna Xs.2 none | Poolside | 6.5 | 3.8 | $0.004 | 1/2 | 439ms |
| #134 | GLM 5.1 medium | Z.ai | 6.4 | 7.0 | $0.727 | 1/2 | 7.47s |
| #153 | Gemini 3 Flash Preview none | 6.4 | 6.8 | $0.085 | 1/2 | 1.58s | |
| #158 | Gemini 3.5 Flash minimal | 6.4 | 6.7 | $0.300 | 1/2 | 893ms |