ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: اختبارات صحيحة ↓.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 6.4 | 5.4 | $0.046 | 1/2 | 55.9s |
| #246 | Inkling Small none | Thinkingmachines | 6.5 | 5.3 | $0.054 | 1/2 | 9.33s |
| #249 | Ling-2.6-1T none | Inclusionai | 6.5 | 5.3 | $0.016 | 1/2 | 23.8s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 6.2 | 5.1 | $0.156 | 1/2 | 136.9s |
| #275 | Nemotron 3.5 Lightning low | NVIDIA | 6.3 | 4.8 | $0.140 | 1/2 | 142.4s |
| #63 | Muse Glimmer 30B xhigh | Meta | 6.0 | 8.1 | $0.471 | 0/2 | 272.7s |
| #65 | Muse Spark 1.1 high | Meta | 5.9 | 8.0 | $2.253 | 0/2 | 70.3s |
| #104 | Gemini 3.8 Flash low | 3.8 | 7.5 | $0.239 | 0/2 | 19.6s | |
| #112 | Gemini 3 Flash Preview low | 3.0 | 7.4 | $0.185 | 0/2 | 10.2s | |
| #128 | Muse Glimmer 30B low | Meta | 3.8 | 7.1 | $0.143 | 0/2 | 132.0s |
| #144 | Gemini 3.5 Flash none | 3.0 | 6.9 | $1.093 | 0/2 | 0ms | |
| #147 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/2 | 102.3s |
| #151 | GLM 5.3 low | Z.ai | 3.8 | 6.8 | $0.257 | 0/2 | 53.0s |
| #153 | Gemini 3 Flash Preview none | 3.8 | 6.8 | $0.085 | 0/2 | 12.4s | |
| #156 | KAT-Coder-Pro V2.5 none | Kwaipilot | 4.1 | 6.7 | $0.487 | 0/2 | 183.1s |