निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #150 | KAT-Coder-Air V2.5 high | Kwaipilot | 9.8 | 5.6 | $0.077 | 2/2 | 1.51s |
| #164 | KAT-Coder-Air V2.5 low | Kwaipilot | 9.8 | 5.4 | $0.041 | 2/2 | 1.64s |
| #184 | Ling-2.6-flash none | Inclusionai | 9.8 | 4.9 | $0.002 | 2/2 | 5.52s |
| #194 | Cobuddy medium | Baidu | 9.8 | 4.7 | $0.000 | 2/2 | 11.6s |
| #199 | Elephant Alpha none | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 1.03s |
| #201 | Elephant Alpha medium | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 987ms |
| #1 | Gemini 3.6 Flash medium | 9.9 | 9.9 | $0.831 | 2/2 | 2.77s | |
| #2 | Gemini 3.6 Flash high | 9.9 | 9.7 | $1.785 | 2/2 | 3.94s | |
| #9 | GPT-5.5 low | OpenAI | 9.9 | 9.3 | $1.253 | 2/2 | 3.74s |
| #12 | Gemini 3.5 Flash medium | 9.9 | 9.1 | $0.642 | 2/2 | 2.70s | |
| #14 | Gemini 3.5 Flash low | 9.9 | 8.9 | $0.433 | 2/2 | 1.86s | |
| #24 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $0.951 | 2/2 | 3.12s |
| #26 | Claude Sonnet 5 medium | Anthropic | 9.9 | 8.3 | $0.922 | 2/2 | 3.10s |
| #42 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.187 | 2/2 | 7.90s |
| #48 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.7 | $1.017 | 2/2 | 1.79s |