ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: إجمالي التكلفة ↑.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #182 | MiMo-V2-Flash medium | Xiaomi | 4.9 | 6.3 | $0.043 | 1/1 | 75.7s |
| #148 | Solar Pro 4 low | Upstage | 6.3 | 6.8 | $0.044 | 1/2 | 358.1s |
| #66 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.8 | 8.0 | $0.044 | 2/2 | 54.2s |
| #177 | LongCat 2.0 none | Meituan | 6.5 | 6.4 | $0.044 | 1/2 | 28.4s |
| #229 | Mimo V2 PRO none | Xiaomi | 1.5 | 5.6 | $0.045 | 0/1 | 6.58s |
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 6.4 | 5.4 | $0.046 | 1/2 | 55.9s |
| #191 | Gemini 3.1 Flash Lite none | 3.0 | 6.1 | $0.046 | 0/2 | 9.49s | |
| #130 | Solar Pro 4 high | Upstage | 7.3 | 7.1 | $0.046 | 1/2 | 167.4s |
| #262 | GLM 5 Turbo none | Z.ai | 1.5 | 5.1 | $0.047 | 0/1 | 4.89s |
| #187 | Gemini 3.1 Flash Lite minimal | 3.0 | 6.1 | $0.047 | 0/2 | 7.75s | |
| #149 | Solar Pro 4 medium | Upstage | 6.4 | 6.8 | $0.047 | 1/2 | 294.8s |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 6.5 | 5.6 | $0.048 | 1/2 | 19.6s |
| #172 | Hy3 preview medium | Tencent | 5.0 | 6.5 | $0.049 | 1/1 | 46.0s |
| #217 | Nemotron 3 Super medium | NVIDIA | 6.4 | 5.7 | $0.050 | 1/2 | 259.9s |
| #92 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.050 | 2/2 | 202.5s |