डोमेन-विशिष्ट क्रमवारी
डोमेन-विशिष्ट मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: एकूण खर्च ↓.
216/216
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | डोमेन-विशिष्ट स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #76 | Qwen3.5-122B-A10B medium | Qwen | 2.9 | 7.1 | $1.046 | 0/3 | 63.4s |
| #72 | Kimi K2.6 medium | Moonshot AI | 5.3 | 7.2 | $1.036 | 1/3 | 202.4s |
| #48 | GPT-5.6 Luna high | OpenAI | 7.7 | 7.7 | $1.017 | 2/3 | 79.0s |
| #32 | Inkling high | Thinkingmachines | 7.7 | 8.0 | $1.006 | 2/3 | 186.4s |
| #5 | GPT-5.6 Sol low | OpenAI | 5.3 | 9.5 | $0.971 | 1/3 | 29.1s |
| #24 | GPT-5.2 medium | OpenAI | 5.9 | 8.4 | $0.951 | 1/3 | 77.8s |
| #23 | Grok 4.5 low | X AI | 3.0 | 8.4 | $0.935 | 0/3 | 72.6s |
| #26 | Claude Sonnet 5 medium | Anthropic | 7.7 | 8.3 | $0.922 | 2/3 | 20.4s |
| #16 | GPT-5.3-Codex medium | OpenAI | 5.9 | 8.9 | $0.920 | 1/3 | 64.3s |
| #125 | Qwen3.5-35B-A3B medium | Qwen | 4.1 | 6.2 | $0.837 | 0/3 | 88.3s |
| #1 | Gemini 3.6 Flash medium | 8.2 | 9.9 | $0.831 | 2/3 | 12.6s | |
| #35 | GLM 5.2 high | Z.ai | 3.7 | 8.0 | $0.817 | 0/3 | 74.0s |
| #77 | Grok 4.3 medium | X AI | 5.3 | 7.1 | $0.779 | 1/3 | 181.7s |
| #105 | Qwen3.6 27B medium | Qwen | 2.9 | 6.5 | $0.779 | 0/3 | 73.4s |
| #79 | Grok 4.20 medium | X AI | 5.3 | 7.1 | $0.777 | 1/3 | 27.0s |