निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #193 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #178 | MiMo-V2.5 medium | Xiaomi | 9.9 | 6.4 | $0.104 | 2/2 | 1.80s |
| #91 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.6 | $0.179 | 2/2 | 1.79s |
| #279 | KAT-Coder-Air V2.5 none | Kwaipilot | 9.9 | 4.8 | $0.070 | 2/2 | 1.75s |
| #162 | Gemini 3.5 Flash Lite low | 9.8 | 6.6 | $0.138 | 2/2 | 1.75s | |
| #77 | Gemini 3.5 Flash Lite medium | 9.8 | 7.8 | $0.272 | 2/2 | 1.72s | |
| #253 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |
| #299 | Laguna Xs.2 medium | Poolside | 10.0 | 4.1 | $0.015 | 2/2 | 1.68s |
| #215 | Solar Pro 4 none | Upstage | 6.4 | 5.8 | $0.006 | 1/2 | 1.67s |
| #169 | Qwen3.5 Plus 2026-02-15 none | Qwen | 10.0 | 6.6 | $0.073 | 2/2 | 1.67s |
| #211 | GLM 5.3 Flash low | Z.ai | 10.0 | 5.9 | $0.015 | 2/2 | 1.65s |
| #222 | Kimi K2.6 none | Moonshot AI | 6.5 | 5.7 | $0.233 | 1/2 | 1.64s |
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 9.8 | 5.4 | $0.046 | 2/2 | 1.64s |
| #265 | Mercury 2.5 Preview low | Inception | 6.3 | 5.0 | $0.011 | 1/2 | 1.60s |