निर्देश पालन रैंकिंग
देखें कि निर्देश पालन में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | निर्देश पालन स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #65 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.177 | 2/2 | 7.02s | |
| #144 | Kimi K2.6 none | Moonshot AI | 6.5 | 5.8 | $0.184 | 1/2 | 1.64s |
| #129 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 9.9 | 6.9 | $0.187 | 2/2 | 2.77s |
| #42 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.187 | 2/2 | 7.90s |
| #63 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 2/2 | 943ms |
| #50 | DeepSeek V4 Pro high | DeepSeek | 7.8 | 7.7 | $0.200 | 1/2 | 8.73s |
| #103 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.6 | $0.231 | 2/2 | 1.40s |
| #39 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 2/2 | 7.26s |
| #29 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.237 | 2/2 | 11.6s |
| #148 | Qwen3.5-122B-A10B none | Qwen | 6.3 | 5.7 | $0.247 | 1/2 | 513ms |
| #123 | GPT-5.6 Luna low | OpenAI | 8.5 | 6.2 | $0.249 | 1/2 | 2.04s |
| #40 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 2/2 | 16.1s |
| #51 | MiniMax M3 medium | Minimax | 9.8 | 7.6 | $0.286 | 2/2 | 6.14s |
| #92 | Gemini 3.5 Flash minimal | 6.4 | 6.8 | $0.300 | 1/2 | 893ms |