निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #34 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $1.055 | 2/2 | 2.14s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 2/2 | 7.26s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 2/2 | 16.1s |
| #37 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 2/2 | 7.54s |
| #38 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.222 | 2/2 | 7.90s |
| #39 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.676 | 2/2 | 1.43s |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.057 | 2/2 | 2.61s |
| #41 | Claude Opus 4.8 low | Anthropic | 9.8 | 7.8 | $2.077 | 2/2 | 2.78s |
| #42 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 2/2 | 7.25s |
| #43 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $3.059 | 2/2 | 2.43s |
| #44 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.7 | $1.017 | 2/2 | 1.79s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 10.0 | 7.7 | $0.042 | 2/2 | 15.4s |
| #47 | MiniMax M3 medium | Minimax | 9.8 | 7.6 | $0.286 | 2/2 | 6.14s |
| #48 | Grok Build 0.1 medium | X AI | 9.8 | 7.6 | $1.097 | 2/2 | 12.4s |
| #49 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |