निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #139 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.479 | 2/2 | 92.5s |
| #287 | Granite 4.2 8B high | IBM Granite | 6.4 | 4.6 | $0.084 | 1/2 | 87.5s |
| #296 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.026 | 0/2 | 79.5s |
| #233 | Hy4 preview low | Tencent | 9.8 | 5.6 | $1.745 | 2/2 | 77.7s |
| #258 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/2 | 75.8s |
| #250 | Gemini 3.1 Flash Lite Preview high | 9.8 | 5.3 | $2.310 | 2/2 | 64.0s | |
| #192 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #148 | Solar Pro 4 low | Upstage | 8.0 | 6.8 | $0.044 | 1/2 | 56.4s |
| #92 | Solar Pro 4 xhigh | Upstage | 8.4 | 7.6 | $0.050 | 1/2 | 51.3s |
| #273 | Hy4 preview none | Tencent | 7.0 | 4.8 | $0.041 | 1/2 | 47.9s |
| #130 | Solar Pro 4 high | Upstage | 7.9 | 7.1 | $0.046 | 1/2 | 41.5s |
| #149 | Solar Pro 4 medium | Upstage | 9.8 | 6.8 | $0.047 | 2/2 | 40.1s |
| #170 | Qwen3.6 27B medium | Qwen | 10.0 | 6.5 | $0.577 | 2/2 | 38.0s |
| #254 | Granite 4.2 8B medium | IBM Granite | 3.8 | 5.2 | $0.009 | 0/2 | 36.9s |
| #133 | DeepSeek V3.2 medium | DeepSeek | 10.0 | 7.0 | $0.078 | 2/2 | 35.8s |