निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #41 | Muse Spark 1.2 high | Meta | 9.8 | 8.7 | $1.771 | 2/2 | 5.43s |
| #42 | Muse Spark 1.2 medium | Meta | 9.8 | 8.6 | $1.339 | 2/2 | 4.40s |
| #44 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.004 | 2/2 | 5.90s |
| #45 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 2/2 | 24.3s |
| #46 | Qwen3.8 Max low | Qwen | 10.0 | 8.6 | $0.702 | 2/2 | 4.01s |
| #47 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #48 | Grok 4.5 medium | X AI | 9.8 | 8.5 | $2.042 | 2/2 | 6.06s |
| #49 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 2.95s |
| #50 | Grok 4.6 medium | X AI | 9.8 | 8.4 | $1.713 | 2/2 | 12.8s |
| #51 | Grok 4.5 low | X AI | 9.8 | 8.4 | $0.945 | 2/2 | 2.80s |
| #52 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $1.182 | 2/2 | 3.12s |
| #53 | Qwen3.8 27B high | Qwen | 9.8 | 8.4 | ~$0.287 | 2/2 | 8.24s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 9.8 | 8.4 | $1.951 | 2/2 | 7.48s |
| #55 | Inkling Small high | Thinkingmachines | 9.8 | 8.4 | $0.398 | 2/2 | 3.94s |
| #58 | Gemini 2.5 Flash medium | 9.8 | 8.2 | $0.644 | 2/2 | 2.62s |