निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #195 | Qwen3.6 Flash none | Qwen | 6.3 | 6.1 | $0.062 | 1/2 | 1.10s |
| #205 | Qwen3.5-Flash none | Qwen | 6.3 | 6.0 | $0.073 | 1/2 | 8.81s |
| #206 | Qwen3.5-35B-A3B none | Qwen | 6.3 | 5.9 | $0.076 | 1/2 | 809ms |
| #212 | GPT-5.4 Mini none | OpenAI | 6.3 | 5.9 | $0.095 | 1/2 | 728ms |
| #223 | Qwen3.5-122B-A10B none | Qwen | 6.3 | 5.7 | $0.283 | 1/2 | 513ms |
| #228 | Gemma 4 26B A4B none | 6.3 | 5.6 | $0.015 | 1/2 | 690ms | |
| #236 | Qwen3.8 27B none | Qwen | 6.3 | 5.5 | ~$0.006 | 1/2 | 582ms |
| #246 | Inkling Small none | Thinkingmachines | 6.3 | 5.3 | $0.054 | 1/2 | 767ms |
| #253 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |
| #259 | Qwen3 Coder Next none | Qwen | 6.3 | 5.1 | $0.026 | 1/2 | 7.78s |
| #268 | GPT-4o-mini none | OpenAI | 6.3 | 5.0 | $0.010 | 1/2 | 1.11s |
| #270 | Mercury 2.5 Preview none | Inception | 6.3 | 4.9 | $0.018 | 1/2 | 1.26s |
| #272 | Nemotron 3 Super none | NVIDIA | 6.3 | 4.8 | $0.008 | 1/2 | 804ms |
| #276 | GPT-5.4 Nano none | OpenAI | 6.3 | 4.8 | $0.041 | 1/2 | 784ms |
| #277 | Trinity Large Thinking high | Arcee AI | 6.3 | 4.8 | $0.592 | 1/2 | 4.12s |