ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: إجمالي التكلفة ↓.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #150 | DeepSeek V4 Pro none | DeepSeek | 7.9 | 6.8 | $0.220 | 1/2 | 71.6s |
| #126 | Muse Glimmer 30B medium | Meta | 6.5 | 7.2 | $0.211 | 1/2 | 76.5s |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 72.1s |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 2/2 | 13.0s | |
| #132 | GPT-5.6 Sol none | OpenAI | 6.5 | 7.0 | $0.201 | 1/2 | 8.37s |
| #106 | Qwen3.7 Max none | Qwen | 6.5 | 7.4 | $0.197 | 1/2 | 37.2s |
| #193 | Inkling low | Thinkingmachines | 2.9 | 6.1 | $0.187 | 0/2 | 22.7s |
| #112 | Gemini 3 Flash Preview low | 3.0 | 7.4 | $0.185 | 0/2 | 10.2s | |
| #91 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 2/2 | 19.0s |
| #294 | GLM 4.7 Flash medium | Z.ai | 2.9 | 4.3 | $0.168 | 0/2 | 802.8s |
| #221 | GLM 5.1 none | Z.ai | 2.8 | 5.7 | $0.164 | 0/2 | 46.9s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 6.2 | 5.1 | $0.156 | 1/2 | 136.9s |
| #155 | GLM 5.2 none | Z.ai | 6.9 | 6.7 | $0.153 | 1/2 | 50.2s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 3.0 | 5.3 | $0.151 | 0/2 | 78.4s |
| #253 | Inkling none | Thinkingmachines | 2.9 | 5.2 | $0.147 | 0/2 | 25.7s |