निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #129 | Step 3.7 Flash low | Stepfun | 9.8 | 7.1 | $0.390 | 2/2 | 1.58s |
| #153 | Gemini 3 Flash Preview none | 6.4 | 6.8 | $0.085 | 1/2 | 1.58s | |
| #40 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 2/2 | 1.57s |
| #166 | Gemini 3.1 Flash Lite low | 10.0 | 6.6 | $0.621 | 2/2 | 1.52s | |
| #267 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #146 | Step 3.7 Flash high | Stepfun | 9.8 | 6.8 | $1.229 | 2/2 | 1.52s |
| #225 | KAT-Coder-Air V2.5 high | Kwaipilot | 9.8 | 5.6 | $0.077 | 2/2 | 1.51s |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 2/2 | 1.50s |
| #164 | Gemini 3.1 Flash Lite Preview low | 10.0 | 6.6 | $0.646 | 2/2 | 1.49s | |
| #96 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 2/2 | 1.48s |
| #218 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 2/2 | 1.48s |
| #198 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 2/2 | 1.46s |
| #161 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 2/2 | 1.46s |
| #79 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 2/2 | 1.43s |
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 5.0 | 5.4 | $0.011 | 0/2 | 1.42s |