ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 3.7 | 5.4 | $0.011 | 0/2 | 202.4s |
| #92 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.050 | 2/2 | 202.5s |
| #125 | Qwen3.7 Flash low | Qwen | 6.4 | 7.2 | $0.043 | 1/2 | 217.8s |
| #171 | Laguna XS 2.1 medium | Poolside | 6.3 | 6.5 | $0.068 | 1/2 | 218.1s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 6.3 | 7.6 | $0.701 | 1/2 | 218.2s |
| #71 | Kimi K3 max | Moonshot AI | 6.5 | 7.9 | $3.467 | 1/2 | 223.0s |
| #61 | Qwen3.8 2.4T A95B low | Qwen | 8.2 | 8.1 | $2.672 | 1/2 | 231.8s |
| #84 | Qwen3.7 Flash high | Qwen | 6.9 | 7.8 | $0.052 | 1/2 | 232.0s |
| #205 | Qwen3.5-Flash none | Qwen | 2.9 | 6.0 | $0.073 | 0/2 | 243.6s |
| #180 | Ring-2.6-1T medium | Inclusionai | 7.3 | 6.4 | $0.102 | 1/2 | 257.3s |
| #217 | Nemotron 3 Super medium | NVIDIA | 6.4 | 5.7 | $0.050 | 1/2 | 259.9s |
| #277 | Trinity Large Thinking high | Arcee AI | 3.0 | 4.8 | $0.592 | 0/2 | 262.4s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 6.9 | 7.4 | $2.357 | 1/2 | 266.1s |
| #192 | Qwen3.5-Flash medium | Qwen | 6.4 | 6.1 | $0.142 | 1/2 | 266.6s |
| #63 | Muse Glimmer 30B xhigh | Meta | 6.0 | 8.1 | $0.471 | 0/2 | 272.7s |