निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #251 | Qwen3.6 35B A3B none | Qwen | 6.2 | 5.3 | $0.051 | 1/2 | 1.86s |
| #185 | GPT-5.6 Luna low | OpenAI | 8.5 | 6.2 | $0.051 | 1/2 | 2.04s |
| #173 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 2/2 | 1.13s | |
| #226 | GLM 5V Turbo none | Z.ai | 6.5 | 5.6 | $0.052 | 1/2 | 1.97s |
| #84 | Qwen3.7 Flash high | Qwen | 9.8 | 7.8 | $0.052 | 2/2 | 9.41s |
| #239 | Laguna S 2.1 medium | Poolside | 4.2 | 5.4 | $0.053 | 0/2 | 400ms |
| #246 | Inkling Small none | Thinkingmachines | 6.3 | 5.3 | $0.054 | 1/2 | 767ms |
| #267 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #219 | Inkling Small low | Thinkingmachines | 9.9 | 5.7 | $0.055 | 2/2 | 1.89s |
| #298 | Grok 4.20 none | X AI | 6.3 | 4.1 | $0.057 | 1/2 | 445ms |
| #81 | Qwen3.8 27B medium | Qwen | 10.0 | 7.8 | ~$0.058 | 2/2 | 2.54s |
| #163 | Qwen3.5-27B none | Qwen | 6.3 | 6.6 | $0.058 | 1/2 | 1.03s |
| #39 | GLM 5.3 Flash max | Z.ai | 9.8 | 8.7 | $0.059 | 2/2 | 3.65s |
| #195 | Qwen3.6 Flash none | Qwen | 6.3 | 6.1 | $0.062 | 1/2 | 1.10s |
| #234 | Qwen3.6 27B none | Qwen | 6.2 | 5.5 | $0.062 | 1/2 | 1.92s |