निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #99 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 2/2 | 1.46s |
| #43 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.676 | 2/2 | 1.43s |
| #103 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.6 | $0.231 | 2/2 | 1.40s |
| #173 | Mistral Small 4 medium | Mistral | 7.3 | 5.1 | $0.096 | 1/2 | 1.38s |
| #213 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #70 | Claude Opus 4.8 none | Anthropic | 9.9 | 7.3 | $1.166 | 2/2 | 1.37s |
| #87 | GPT-5.6 Sol none | OpenAI | 8.5 | 6.9 | $0.524 | 1/2 | 1.33s |
| #165 | GPT-5.6 Luna none | OpenAI | 7.1 | 5.4 | $0.142 | 1/2 | 1.23s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.2 | 6.1 | $0.122 | 1/2 | 1.17s |
| #91 | GPT-5.5 none | OpenAI | 6.2 | 6.9 | $0.544 | 1/2 | 1.15s |
| #138 | GPT-5.6 Terra none | OpenAI | 8.5 | 6.0 | $0.349 | 1/2 | 1.15s |
| #112 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 2/2 | 1.13s | |
| #180 | GPT-4o-mini none | OpenAI | 6.3 | 5.0 | $0.010 | 1/2 | 1.11s |
| #130 | Qwen3.6 Flash none | Qwen | 6.3 | 6.1 | $0.062 | 1/2 | 1.10s |
| #145 | GPT-5.4 none | OpenAI | 6.5 | 5.8 | $0.397 | 1/2 | 1.07s |