निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #123 | Muse Glimmer 30B high | Meta | 8.4 | 7.2 | $0.397 | 1/2 | 8.62s |
| #88 | DeepSeek V4 Pro high | DeepSeek | 7.8 | 7.7 | $0.476 | 1/2 | 8.73s |
| #205 | Qwen3.5-Flash none | Qwen | 6.3 | 6.0 | $0.073 | 1/2 | 8.81s |
| #63 | Muse Glimmer 30B xhigh | Meta | 8.4 | 8.1 | $0.471 | 1/2 | 8.90s |
| #142 | Qwen3.7 Flash medium | Qwen | 5.8 | 6.9 | $0.065 | 0/2 | 9.27s |
| #315 | Step 3.5 Flash none | Stepfun | 5.0 | 2.3 | $0.020 | 1/1 | 9.30s |
| #84 | Qwen3.7 Flash high | Qwen | 9.8 | 7.8 | $0.052 | 2/2 | 9.41s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 2/2 | 9.56s | |
| #125 | Qwen3.7 Flash low | Qwen | 8.5 | 7.2 | $0.043 | 1/2 | 9.88s |
| #127 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.207 | 2/2 | 9.88s |
| #227 | Owl Alpha medium | Openrouter | 6.5 | 5.6 | $0.000 | 1/2 | 10.2s |
| #147 | Seed-2.0-Code medium | Bytedance Seed | 9.8 | 6.8 | $1.153 | 2/2 | 10.3s |
| #34 | Muse Spark 1.3 medium | Meta | 9.8 | 8.8 | $1.469 | 2/2 | 10.5s |
| #143 | Seed-2.0-Code high | Bytedance Seed | 9.8 | 6.9 | $1.273 | 2/2 | 11.3s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 9.8 | 7.4 | $2.357 | 2/2 | 11.4s |