सूचनांचे पालन क्रमवारी
सूचनांचे पालन मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: मेट्रिक ↑.
319/319
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | सूचनांचे पालन स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #88 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #90 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $2.961 | 2/2 | 2.43s |
| #92 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 7.6 | $0.042 | 2/2 | 15.4s |
| #93 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |
| #97 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 2/2 | 2.81s |
| #99 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 2/2 | 1.48s |
| #102 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 2/2 | 31.9s |
| #103 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 2/2 | 19.7s |
| #107 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 2/2 | 2.79s | |
| #108 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 2/2 | 1.91s | |
| #109 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 2/2 | 943ms |
| #118 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 2/2 | 2.53s |
| #119 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.029 | 2/2 | 2.06s |
| #124 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.247 | 2/2 | 12.5s |
| #127 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.323 | 2/2 | 20.2s |