निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #165 | Inkling Small medium | Thinkingmachines | 8.5 | 6.6 | $0.113 | 1/2 | 3.78s |
| #185 | GPT-5.6 Luna low | OpenAI | 8.5 | 6.2 | $0.051 | 1/2 | 2.04s |
| #208 | Dots 3 Note Preview medium | Dots Studio | 8.5 | 5.9 | $0.000 | 1/2 | 7.77s |
| #232 | Nemotron 3.5 Lightning high | NVIDIA | 8.5 | 5.6 | $0.134 | 1/2 | 4.98s |
| #132 | GPT-5.6 Sol none | OpenAI | 8.5 | 7.0 | $0.201 | 1/2 | 1.33s |
| #202 | GPT-5.6 Terra none | OpenAI | 8.5 | 6.0 | $0.280 | 1/2 | 1.15s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 8.5 | 5.1 | $0.156 | 1/2 | 3.75s |
| #17 | Grok 4.6 high | X AI | 9.8 | 9.3 | $1.908 | 2/2 | 13.8s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 9.8 | 9.1 | $1.546 | 2/2 | 5.05s |
| #29 | Grok 4.5 high | X AI | 9.8 | 9.0 | $2.252 | 2/2 | 6.23s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 9.8 | 8.9 | $1.797 | 2/2 | 7.66s |
| #35 | Gemini 3.5 Flash Lite high | 9.8 | 8.8 | $0.540 | 2/2 | 2.16s | |
| #41 | Muse Spark 1.2 high | Meta | 9.8 | 8.7 | $1.771 | 2/2 | 5.43s |
| #42 | Muse Spark 1.2 medium | Meta | 9.8 | 8.6 | $1.339 | 2/2 | 4.40s |
| #48 | Grok 4.5 medium | X AI | 9.8 | 8.5 | $2.042 | 2/2 | 6.06s |