ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: المقياس ↑.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #235 | Hy3 preview low | Tencent | 5.0 | 5.5 | $0.042 | 1/1 | 78.7s |
| #250 | Gemini 3.1 Flash Lite Preview high | 5.0 | 5.3 | $2.310 | 1/1 | 280.5s | |
| #269 | Qwen3.6 Plus Preview medium | Qwen | 5.0 | 4.9 | $0.000 | 1/1 | 35.0s |
| #283 | Grok 4.1 Fast medium | X AI | 5.0 | 4.7 | $0.069 | 1/1 | 37.6s |
| #287 | Granite 4.2 8B high | IBM Granite | 5.0 | 4.6 | $0.084 | 0/2 | 570.4s |
| #223 | Qwen3.5-122B-A10B none | Qwen | 5.2 | 5.7 | $0.283 | 0/2 | 129.3s |
| #199 | Trinity Large Thinking low | Arcee AI | 5.2 | 6.0 | $0.625 | 0/2 | 291.0s |
| #65 | Muse Spark 1.1 high | Meta | 5.9 | 8.0 | $2.253 | 0/2 | 70.3s |
| #63 | Muse Glimmer 30B xhigh | Meta | 6.0 | 8.1 | $0.471 | 0/2 | 272.7s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 6.2 | 5.1 | $0.156 | 1/2 | 136.9s |
| #275 | Nemotron 3.5 Lightning low | NVIDIA | 6.3 | 4.8 | $0.140 | 1/2 | 142.4s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 6.3 | 7.6 | $0.701 | 1/2 | 218.2s |
| #148 | Solar Pro 4 low | Upstage | 6.3 | 6.8 | $0.044 | 1/2 | 358.1s |
| #154 | Gemma 4 26B A4B medium | 6.3 | 6.8 | $0.092 | 1/2 | 492.9s | |
| #171 | Laguna XS 2.1 medium | Poolside | 6.3 | 6.5 | $0.068 | 1/2 | 218.1s |