ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #232 | Nemotron 3.5 Lightning high | NVIDIA | 6.4 | 5.6 | $0.134 | 1/2 | 160.5s |
| #154 | Gemma 4 26B A4B medium | 6.3 | 6.8 | $0.092 | 1/2 | 492.9s | |
| #171 | Laguna XS 2.1 medium | Poolside | 6.3 | 6.5 | $0.068 | 1/2 | 218.1s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 6.3 | 7.6 | $0.701 | 1/2 | 218.2s |
| #148 | Solar Pro 4 low | Upstage | 6.3 | 6.8 | $0.044 | 1/2 | 358.1s |
| #275 | Nemotron 3.5 Lightning low | NVIDIA | 6.3 | 4.8 | $0.140 | 1/2 | 142.4s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 6.2 | 5.1 | $0.156 | 1/2 | 136.9s |
| #63 | Muse Glimmer 30B xhigh | Meta | 6.0 | 8.1 | $0.471 | 0/2 | 272.7s |
| #65 | Muse Spark 1.1 high | Meta | 5.9 | 8.0 | $2.253 | 0/2 | 70.3s |
| #199 | Trinity Large Thinking low | Arcee AI | 5.2 | 6.0 | $0.625 | 0/2 | 291.0s |
| #223 | Qwen3.5-122B-A10B none | Qwen | 5.2 | 5.7 | $0.283 | 0/2 | 129.3s |
| #287 | Granite 4.2 8B high | IBM Granite | 5.0 | 4.6 | $0.084 | 0/2 | 570.4s |
| #78 | GLM 5.2 medium | Z.ai | 5.0 | 7.8 | $0.224 | 1/1 | 52.0s |
| #85 | GLM 5 medium | Z.ai | 5.0 | 7.7 | $0.228 | 1/1 | 29.0s |
| #90 | GLM 5 Turbo medium | Z.ai | 5.0 | 7.6 | $0.323 | 1/1 | 13.9s |