निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #128 | Muse Glimmer 30B low | Meta | 8.4 | 7.1 | $0.143 | 1/2 | 3.60s |
| #253 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #155 | GLM 5.2 none | Z.ai | 9.8 | 6.7 | $0.153 | 2/2 | 3.84s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 8.5 | 5.1 | $0.156 | 1/2 | 3.75s |
| #221 | GLM 5.1 none | Z.ai | 9.8 | 5.7 | $0.164 | 2/2 | 1.98s |
| #294 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #91 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.6 | $0.179 | 2/2 | 1.79s |
| #112 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.185 | 2/2 | 7.02s | |
| #193 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #106 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 2/2 | 943ms |
| #132 | GPT-5.6 Sol none | OpenAI | 8.5 | 7.0 | $0.201 | 1/2 | 1.33s |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 2/2 | 2.47s | |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 12.8s |
| #126 | Muse Glimmer 30B medium | Meta | 9.8 | 7.2 | $0.211 | 2/2 | 5.34s |