निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #150 | DeepSeek V4 Pro none | DeepSeek | 6.3 | 6.8 | $0.220 | 1/2 | 4.12s |
| #152 | MiMo-V2.5-Pro medium | Xiaomi | 9.9 | 6.8 | $0.221 | 2/2 | 2.77s |
| #78 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.224 | 2/2 | 7.90s |
| #85 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #174 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.4 | $0.228 | 2/2 | 1.40s |
| #222 | Kimi K2.6 none | Moonshot AI | 6.5 | 5.7 | $0.233 | 1/2 | 1.64s |
| #82 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 2/2 | 7.26s |
| #104 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 2/2 | 2.79s | |
| #62 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 2/2 | 11.6s |
| #38 | Gemini 3.6 Flash low | 9.8 | 8.7 | $0.251 | 2/2 | 2.82s | |
| #151 | GLM 5.3 low | Z.ai | 10.0 | 6.8 | $0.257 | 2/2 | 3.40s |
| #77 | Gemini 3.5 Flash Lite medium | 9.8 | 7.8 | $0.272 | 2/2 | 1.72s | |
| #75 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 2/2 | 16.1s |
| #202 | GPT-5.6 Terra none | OpenAI | 8.5 | 6.0 | $0.280 | 1/2 | 1.15s |
| #223 | Qwen3.5-122B-A10B none | Qwen | 6.3 | 5.7 | $0.283 | 1/2 | 513ms |