निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #239 | Laguna S 2.1 medium | Poolside | 4.2 | 5.4 | $0.053 | 0/2 | 400ms |
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 5.0 | 5.4 | $0.011 | 0/2 | 1.42s |
| #245 | Laguna S 2.1 high | Poolside | 4.6 | 5.4 | $0.114 | 0/2 | 453ms |
| #247 | Laguna XS 2.1 none | Poolside | 3.8 | 5.3 | $0.008 | 0/2 | 364ms |
| #252 | Dots 3 Note Preview none | Dots Studio | 4.8 | 5.2 | $0.000 | 0/2 | 1.06s |
| #254 | Granite 4.2 8B medium | IBM Granite | 3.8 | 5.2 | $0.009 | 0/2 | 36.9s |
| #258 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/2 | 75.8s |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 12.8s |
| #266 | Laguna S 2.1 low | Poolside | 4.3 | 5.0 | $0.082 | 0/2 | 423ms |
| #281 | Trinity Large Preview none | Arcee AI | 3.5 | 4.8 | $0.008 | 0/2 | 822ms |
| #290 | Laguna S 2.1 none | Poolside | 4.3 | 4.5 | $0.022 | 0/2 | 566ms |
| #296 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.026 | 0/2 | 79.5s |
| #302 | Ling 3.0 Tiny none | Inclusionai | 3.1 | 4.0 | $0.000 | 0/2 | 2.44s |
| #303 | Granite 4.1 8B none | IBM Granite | 3.6 | 4.0 | $0.007 | 0/2 | 344ms |
| #308 | Grok 4.1 Fast none | X AI | 3.0 | 3.8 | $0.008 | 0/2 | 685ms |