निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #235 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.042 | 2/2 | 16.0s |
| #75 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 2/2 | 16.1s |
| #138 | Seed-2.0-Mini medium | Bytedance Seed | 10.0 | 7.0 | $0.116 | 2/2 | 17.5s |
| #154 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.092 | 2/2 | 17.5s | |
| #238 | DeepSeek V4 Flash 0423 none | DeepSeek | 6.5 | 5.4 | $0.039 | 1/2 | 17.5s |
| #131 | Grok 4.3 medium | X AI | 9.8 | 7.0 | $0.741 | 2/2 | 18.6s |
| #61 | Qwen3.8 2.4T A95B low | Qwen | 9.8 | 8.1 | $2.672 | 2/2 | 19.5s |
| #100 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 2/2 | 19.7s |
| #124 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.323 | 2/2 | 20.2s |
| #224 | Gemini 3.1 Flash Lite high | 7.3 | 5.6 | $2.044 | 1/2 | 23.3s | |
| #45 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 2/2 | 24.3s |
| #188 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $0.675 | 2/2 | 24.4s |
| #274 | Ring-2.6-1T none | Inclusionai | 9.8 | 4.8 | $0.026 | 2/2 | 27.4s |
| #263 | North Mini Code none | Cohere | 6.5 | 5.1 | $0.000 | 1/2 | 30.7s |
| #99 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 2/2 | 31.9s |