संयुक्त क्रमवारी
संयुक्त मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा.
अयशस्वी होण्याची कारणे
316/316
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | संयुक्त स्कोअर | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #135 | GPT-5.5 none | OpenAI | 6.5 | 7.0 | $0.544 | 1/2 | 8.90s |
| #145 | Qwen3.6 Flash medium | Qwen | 6.5 | 6.8 | $0.741 | 1/2 | 299.2s |
| #169 | Qwen3.5 Plus 2026-02-15 none | Qwen | 6.5 | 6.6 | $0.073 | 1/2 | 64.8s |
| #174 | Qwen3.6 Max Preview none | Qwen | 6.5 | 6.4 | $0.228 | 1/2 | 61.6s |
| #177 | LongCat 2.0 none | Meituan | 6.5 | 6.4 | $0.044 | 1/2 | 28.4s |
| #186 | Claude Sonnet 5 none | Anthropic | 6.5 | 6.1 | $0.548 | 1/2 | 31.4s |
| #189 | gpt-oss-120b medium | OpenAI | 6.5 | 6.1 | $0.020 | 1/2 | 24.0s |
| #207 | Step 3.5 Flash medium | Stepfun | 6.5 | 5.9 | $0.132 | 1/2 | 813.7s |
| #212 | GPT-5.4 Mini none | OpenAI | 6.5 | 5.9 | $0.095 | 1/2 | 6.22s |
| #225 | KAT-Coder-Air V2.5 high | Kwaipilot | 6.5 | 5.6 | $0.077 | 1/2 | 74.5s |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 6.5 | 5.6 | $0.048 | 1/2 | 19.6s |
| #246 | Inkling Small none | Thinkingmachines | 6.5 | 5.3 | $0.054 | 1/2 | 9.33s |
| #249 | Ling-2.6-1T none | Inclusionai | 6.5 | 5.3 | $0.016 | 1/2 | 23.8s |
| #82 | Seed-2.0-Lite medium | Bytedance Seed | 6.4 | 7.8 | $0.236 | 1/2 | 58.5s |
| #89 | DeepSeek V4 Flash 0423 high | DeepSeek | 6.4 | 7.6 | $0.042 | 1/2 | 104.1s |