निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #210 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.135 | 2/2 | 34.4s |
| #133 | DeepSeek V3.2 medium | DeepSeek | 10.0 | 7.0 | $0.078 | 2/2 | 35.8s |
| #254 | Granite 4.2 8B medium | IBM Granite | 3.8 | 5.2 | $0.009 | 0/2 | 36.9s |
| #170 | Qwen3.6 27B medium | Qwen | 10.0 | 6.5 | $0.577 | 2/2 | 38.0s |
| #149 | Solar Pro 4 medium | Upstage | 9.8 | 6.8 | $0.047 | 2/2 | 40.1s |
| #130 | Solar Pro 4 high | Upstage | 7.9 | 7.1 | $0.046 | 1/2 | 41.5s |
| #273 | Hy4 preview none | Tencent | 7.0 | 4.8 | $0.041 | 1/2 | 47.9s |
| #92 | Solar Pro 4 xhigh | Upstage | 8.4 | 7.6 | $0.050 | 1/2 | 51.3s |
| #148 | Solar Pro 4 low | Upstage | 8.0 | 6.8 | $0.044 | 1/2 | 56.4s |
| #192 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #250 | Gemini 3.1 Flash Lite Preview high | 9.8 | 5.3 | $2.310 | 2/2 | 64.0s | |
| #258 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/2 | 75.8s |
| #233 | Hy4 preview low | Tencent | 9.8 | 5.6 | $1.745 | 2/2 | 77.7s |
| #296 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.026 | 0/2 | 79.5s |
| #287 | Granite 4.2 8B high | IBM Granite | 6.4 | 4.6 | $0.084 | 1/2 | 87.5s |