निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #65 | Muse Spark 1.1 high | Meta | 6.4 | 8.0 | $2.253 | 1/2 | 7.81s |
| #29 | Grok 4.5 high | X AI | 9.8 | 9.0 | $2.252 | 2/2 | 6.23s |
| #80 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 2/2 | 2.61s |
| #83 | Claude Opus 4.8 low | Anthropic | 9.8 | 7.8 | $2.089 | 2/2 | 2.78s |
| #224 | Gemini 3.1 Flash Lite high | 7.3 | 5.6 | $2.044 | 1/2 | 23.3s | |
| #48 | Grok 4.5 medium | X AI | 9.8 | 8.5 | $2.042 | 2/2 | 6.06s |
| #11 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 2/2 | 3.35s | |
| #36 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 2/2 | 3.32s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 9.8 | 8.4 | $1.951 | 2/2 | 7.48s |
| #17 | Grok 4.6 high | X AI | 9.8 | 9.3 | $1.908 | 2/2 | 13.8s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 9.8 | 8.9 | $1.797 | 2/2 | 7.66s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 2/2 | 2.86s |
| #41 | Muse Spark 1.2 high | Meta | 9.8 | 8.7 | $1.771 | 2/2 | 5.43s |
| #233 | Hy4 preview low | Tencent | 9.8 | 5.6 | $1.745 | 2/2 | 77.7s |
| #50 | Grok 4.6 medium | X AI | 9.8 | 8.4 | $1.713 | 2/2 | 12.8s |