निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #78 | GLM 5.1 medium | Z.ai | 6.4 | 7.1 | $0.535 | 1/2 | 7.47s |
| #11 | Qwen3.7 Max medium | Qwen | 10.0 | 9.2 | $1.116 | 2/2 | 7.46s |
| #64 | LongCat 2.0 medium | Meituan | 6.5 | 7.4 | $0.478 | 1/2 | 7.38s |
| #208 | Grok Build 0.1 none | X AI | 9.8 | 4.0 | $0.547 | 2/2 | 7.36s |
| #39 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 2/2 | 7.26s |
| #46 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 2/2 | 7.25s |
| #65 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.177 | 2/2 | 7.02s | |
| #32 | Inkling high | Thinkingmachines | 9.8 | 8.0 | $1.006 | 2/2 | 7.00s |
| #146 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.055 | 1/2 | 6.97s |
| #102 | LongCat 2.0 high | Meituan | 6.5 | 6.6 | $0.469 | 1/2 | 6.96s |
| #96 | LongCat 2.0 low | Meituan | 6.5 | 6.7 | $0.391 | 1/2 | 6.39s |
| #55 | Nemotron 3 Ultra medium | NVIDIA | 9.8 | 7.5 | $0.774 | 2/2 | 6.35s |
| #19 | Muse Spark 1.1 medium | Meta | 6.5 | 8.6 | $1.357 | 1/2 | 6.31s |
| #15 | Grok 4.5 high | X AI | 9.8 | 8.9 | $1.707 | 2/2 | 6.23s |
| #36 | Inkling medium | Thinkingmachines | 9.8 | 8.0 | $0.391 | 2/2 | 6.17s |