निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #301 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #220 | Ling-3.0-flash none | Inclusionai | 4.8 | 5.7 | $0.004 | 0/2 | 836ms |
| #281 | Trinity Large Preview none | Arcee AI | 3.5 | 4.8 | $0.008 | 0/2 | 822ms |
| #206 | Qwen3.5-35B-A3B none | Qwen | 6.3 | 5.9 | $0.076 | 1/2 | 809ms |
| #272 | Nemotron 3 Super none | NVIDIA | 6.3 | 4.8 | $0.008 | 1/2 | 804ms |
| #276 | GPT-5.4 Nano none | OpenAI | 6.3 | 4.8 | $0.041 | 1/2 | 784ms |
| #246 | Inkling Small none | Thinkingmachines | 6.3 | 5.3 | $0.054 | 1/2 | 767ms |
| #316 | LFM2-24B-A2B none | Liquid | 6.3 | 2.2 | $0.001 | 1/2 | 752ms |
| #260 | MiMo-V2.5 none | Xiaomi | 6.5 | 5.1 | $0.025 | 1/2 | 751ms |
| #212 | GPT-5.4 Mini none | OpenAI | 6.3 | 5.9 | $0.095 | 1/2 | 728ms |
| #228 | Gemma 4 26B A4B none | 6.3 | 5.6 | $0.015 | 1/2 | 690ms | |
| #308 | Grok 4.1 Fast none | X AI | 3.0 | 3.8 | $0.008 | 0/2 | 685ms |
| #292 | Laguna M.1 none | Poolside | 6.3 | 4.4 | $0.009 | 1/2 | 683ms |
| #291 | Grok 4.20 Beta none | X AI | 6.3 | 4.4 | $0.087 | 1/2 | 649ms |
| #289 | MiniMax M2.5 medium | Minimax | 7.5 | 4.6 | $0.327 | 1/2 | 621ms |