निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #150 | DeepSeek V4 Pro none | DeepSeek | 6.3 | 6.8 | $0.220 | 1/2 | 4.12s |
| #126 | Muse Glimmer 30B medium | Meta | 9.8 | 7.2 | $0.211 | 2/2 | 5.34s |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 12.8s |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 2/2 | 2.47s | |
| #132 | GPT-5.6 Sol none | OpenAI | 8.5 | 7.0 | $0.201 | 1/2 | 1.33s |
| #106 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 2/2 | 943ms |
| #193 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #112 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.185 | 2/2 | 7.02s | |
| #91 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.6 | $0.179 | 2/2 | 1.79s |
| #294 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #221 | GLM 5.1 none | Z.ai | 9.8 | 5.7 | $0.164 | 2/2 | 1.98s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 8.5 | 5.1 | $0.156 | 1/2 | 3.75s |
| #155 | GLM 5.2 none | Z.ai | 9.8 | 6.7 | $0.153 | 2/2 | 3.84s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #253 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |