निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #4 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $3.474 | 2/2 | 3.58s |
| #278 | Grok 4.20 Multi Agent Beta medium | X AI | 9.8 | 4.8 | $5.599 | 2/2 | 3.52s |
| #98 | GPT 5.3 Chat none | OpenAI | 9.8 | 7.5 | $0.533 | 2/2 | 3.51s |
| #28 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 2/2 | 3.49s |
| #269 | Qwen3.6 Plus Preview medium | Qwen | 6.5 | 4.9 | $0.000 | 1/2 | 3.40s |
| #151 | GLM 5.3 low | Z.ai | 10.0 | 6.8 | $0.257 | 2/2 | 3.40s |
| #144 | Gemini 3.5 Flash none | 9.8 | 6.9 | $1.093 | 2/2 | 3.38s | |
| #27 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 2/2 | 3.36s |
| #181 | Mimo V2 PRO medium | Xiaomi | 9.9 | 6.3 | $0.333 | 2/2 | 3.36s |
| #11 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 2/2 | 3.35s | |
| #36 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 2/2 | 3.32s |
| #203 | Gemini 3 PRO Preview medium | 9.8 | 6.0 | $0.385 | 2/2 | 3.26s | |
| #52 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $1.182 | 2/2 | 3.12s |
| #47 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #306 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |