संयुक्त क्रमवारी
संयुक्त मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: बरोबर चाचण्या ↑.
अयशस्वी होण्याची कारणे
210/210
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | संयुक्त स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #116 | Seed-2.0-Lite none | Bytedance Seed | 3.0 | 6.2 | $0.066 | 0/2 | 25.6s |
| #117 | GPT-5.6 Luna low | OpenAI | 2.8 | 6.2 | $0.249 | 0/2 | 13.7s |
| #118 | Gemini 2.5 Flash none | 3.0 | 6.2 | $0.017 | 0/2 | 61.2s | |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 3.8 | 6.2 | $0.837 | 0/2 | 512.8s |
| #120 | Gemini 3.1 Flash Lite minimal | 3.0 | 6.1 | $0.047 | 0/2 | 7.75s | |
| #122 | Gemini 3.1 Flash Lite none | 3.0 | 6.1 | $0.046 | 0/2 | 9.49s | |
| #123 | Inkling low | Thinkingmachines | 2.9 | 6.1 | $0.187 | 0/2 | 22.7s |
| #124 | Qwen3.6 Flash none | Qwen | 3.8 | 6.1 | $0.062 | 0/2 | 26.5s |
| #125 | Qwen3.5-Flash none | Qwen | 2.9 | 6.1 | $0.073 | 0/2 | 243.6s |
| #127 | Qwen3.5-35B-A3B none | Qwen | 3.8 | 6.1 | $0.106 | 0/2 | 128.3s |
| #129 | Nemotron 3 Ultra none | NVIDIA | 3.0 | 6.1 | $0.095 | 0/2 | 21.1s |
| #132 | GPT-5.6 Terra none | OpenAI | 2.9 | 6.0 | $0.349 | 0/2 | 7.02s |
| #133 | Gemini 3 PRO Preview medium | 1.5 | 6.0 | $0.385 | 0/1 | 10.4s | |
| #137 | North Mini Code medium | Cohere | 2.9 | 5.9 | $0.000 | 0/2 | 554.9s |
| #138 | Kimi K2.6 none | Moonshot AI | 3.0 | 5.8 | $0.184 | 0/2 | 77.8s |