निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #301 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #191 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 2/2 | 859ms | |
| #280 | GLM 4.7 Flash none | Z.ai | 6.5 | 4.8 | $0.016 | 1/2 | 888ms |
| #190 | Qwen3.7 Flash none | Qwen | 6.3 | 6.1 | $0.019 | 1/2 | 892ms |
| #158 | Gemini 3.5 Flash minimal | 6.4 | 6.7 | $0.300 | 1/2 | 893ms | |
| #118 | Qwen3.7 Plus none | Qwen | 6.3 | 7.3 | $0.106 | 1/2 | 929ms |
| #187 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 2/2 | 932ms | |
| #106 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 2/2 | 943ms |
| #295 | Elephant Alpha medium | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 987ms |
| #242 | MiMo-V2.5-Pro none | Xiaomi | 6.4 | 5.4 | $0.068 | 1/2 | 1.03s |
| #163 | Qwen3.5-27B none | Qwen | 6.3 | 6.6 | $0.058 | 1/2 | 1.03s |
| #293 | Elephant Alpha none | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 1.03s |
| #168 | Mercury 2.5 Preview high | Inception | 9.8 | 6.6 | $0.030 | 2/2 | 1.05s |
| #252 | Dots 3 Note Preview none | Dots Studio | 4.8 | 5.2 | $0.000 | 0/2 | 1.06s |
| #183 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 2/2 | 1.06s |