निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #107 | Kimi K2.7 Code medium | Moonshot AI | 9.9 | 7.4 | $0.687 | 2/2 | 5.39s |
| #56 | Muse Spark 1.1 low | Meta | 7.3 | 8.3 | $0.673 | 1/2 | 5.42s |
| #41 | Muse Spark 1.2 high | Meta | 9.8 | 8.7 | $1.771 | 2/2 | 5.43s |
| #275 | Nemotron 3.5 Lightning low | NVIDIA | 8.4 | 4.8 | $0.140 | 1/2 | 5.46s |
| #72 | GPT-5.2 Chat none | OpenAI | 9.8 | 7.9 | $0.594 | 2/2 | 5.51s |
| #271 | Ling-2.6-flash none | Inclusionai | 9.8 | 4.9 | $0.002 | 2/2 | 5.52s |
| #25 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 2/2 | 5.60s |
| #309 | Qwen3.5-9B medium | Qwen | 6.5 | 3.8 | $0.062 | 1/2 | 5.75s |
| #57 | Claude Fable 5.1 medium | Anthropic | 7.3 | 8.3 | $2.909 | 1/2 | 5.77s |
| #44 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.004 | 2/2 | 5.90s |
| #145 | Qwen3.6 Flash medium | Qwen | 10.0 | 6.8 | $0.741 | 2/2 | 6.05s |
| #48 | Grok 4.5 medium | X AI | 9.8 | 8.5 | $2.042 | 2/2 | 6.06s |
| #97 | MiniMax M3 medium | Minimax | 9.8 | 7.5 | $0.300 | 2/2 | 6.14s |
| #172 | Hy3 preview medium | Tencent | 10.0 | 6.5 | $0.049 | 2/2 | 6.16s |
| #69 | Inkling medium | Thinkingmachines | 9.8 | 8.0 | $0.383 | 2/2 | 6.17s |