डोमेन-विशिष्ट क्रमवारी
डोमेन-विशिष्ट मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: बरोबर चाचण्या ↑.
343/343
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | डोमेन-विशिष्ट स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 5.3 | 8.5 | $0.287 | 1/3 | 127.3s |
| #55 | Grok 4.5 medium | X AI | 5.3 | 8.5 | $2.042 | 1/3 | 249.3s |
| #56 | Muse Spark 1.2 low | Meta | 5.3 | 8.4 | $0.655 | 1/3 | 28.5s |
| #57 | Grok 4.6 medium | X AI | 5.3 | 8.4 | $1.713 | 1/3 | 304.3s |
| #59 | GPT-5.2 medium | OpenAI | 5.9 | 8.4 | $1.182 | 1/3 | 97.3s |
| #60 | Qwen3.8 27B high | Qwen | 5.3 | 8.4 | ~$0.287 | 1/3 | 526.7s |
| #63 | Inkling Small high | Thinkingmachines | 5.3 | 8.4 | $0.398 | 1/3 | 56.3s |
| #68 | Gemini 2.5 Flash medium | 5.9 | 8.2 | $0.644 | 1/3 | 37.1s | |
| #70 | Claude Sonnet 5 medium | Anthropic | 5.3 | 8.2 | $0.922 | 1/3 | 20.5s |
| #74 | Grok 4.7 medium | X AI | 5.3 | 8.1 | $2.254 | 1/3 | 300.4s |
| #80 | Inkling medium | Thinkingmachines | 5.3 | 8.0 | $0.383 | 1/3 | 31.6s |
| #81 | GPT-5.6 Terra high | OpenAI | 5.3 | 8.0 | $0.836 | 1/3 | 42.6s |
| #82 | Grok 4.7 low | X AI | 5.3 | 7.9 | $1.320 | 1/3 | 159.1s |
| #83 | Kimi K3 max | Moonshot AI | 5.3 | 7.9 | $3.467 | 1/3 | 683.6s |
| #85 | Step 3.7 Flash medium | Stepfun | 5.3 | 7.9 | $0.495 | 1/3 | 27.3s |