सूचनांचे पालन क्रमवारी
सूचनांचे पालन मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: बरोबर चाचण्या ↓.
319/319
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | सूचनांचे पालन स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #82 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 2/2 | 1.43s |
| #83 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 2/2 | 2.61s |
| #84 | Qwen3.8 27B medium | Qwen | 10.0 | 7.8 | ~$0.058 | 2/2 | 2.54s |
| #85 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 2/2 | 7.26s |
| #86 | Claude Opus 4.8 low | Anthropic | 9.8 | 7.8 | $2.089 | 2/2 | 2.78s |
| #87 | Qwen3.7 Flash high | Qwen | 9.8 | 7.8 | $0.052 | 2/2 | 9.41s |
| #88 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #89 | Seed-2.0-Code low | Bytedance Seed | 9.8 | 7.7 | $0.767 | 2/2 | 12.2s |
| #90 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $2.961 | 2/2 | 2.43s |
| #92 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 7.6 | $0.042 | 2/2 | 15.4s |
| #93 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |
| #94 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.6 | $0.179 | 2/2 | 1.79s |
| #96 | Nemotron 3 Ultra medium | NVIDIA | 9.8 | 7.6 | $0.701 | 2/2 | 6.35s |
| #97 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 2/2 | 2.81s |
| #98 | GPT-5.4 Nano medium | OpenAI | 9.8 | 7.5 | $0.142 | 2/2 | 1.88s |