निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
316/316
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #182 | MiMo-V2-Flash medium | Xiaomi | 10.0 | 6.3 | $0.043 | 2/2 | 4.28s |
| #183 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 2/2 | 1.06s |
| #184 | Gemma 4 31B medium | 10.0 | 6.2 | $0.100 | 2/2 | 12.8s | |
| #187 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 2/2 | 932ms | |
| #188 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $0.675 | 2/2 | 24.4s |
| #191 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 2/2 | 859ms | |
| #192 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #198 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 2/2 | 1.46s |
| #200 | Gemini 2.5 Flash none | 10.0 | 6.0 | $0.017 | 2/2 | 590ms | |
| #210 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.135 | 2/2 | 34.4s |
| #211 | GLM 5.3 Flash low | Z.ai | 10.0 | 5.9 | $0.015 | 2/2 | 1.65s |
| #218 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 2/2 | 1.48s |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 2/2 | 1.50s |
| #235 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.042 | 2/2 | 16.0s |
| #267 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |