ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: اختبارات صحيحة ↑.
311/311
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #161 | Gemini 3.1 Flash Lite low | 3.2 | 6.6 | $0.621 | 0/2 | 161.2s | |
| #162 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.6 | $0.672 | 0/2 | 817.6s |
| #163 | Mercury 2.5 Preview high | Inception | 3.8 | 6.6 | $0.030 | 0/2 | 14.4s |
| #165 | Qwen3.6 27B medium | Qwen | 6.7 | 6.5 | $1.045 | 0/2 | 584.1s |
| #168 | Gemini 3.1 Flash Lite Preview none | 3.0 | 6.4 | $0.052 | 0/2 | 6.23s | |
| #174 | Ling-3.0-flash high | Inclusionai | 2.9 | 6.4 | $0.021 | 0/2 | 50.4s |
| #176 | Mimo V2 PRO medium | Xiaomi | 2.3 | 6.3 | $0.333 | 0/1 | 64.7s |
| #178 | Seed-2.0-Lite none | Bytedance Seed | 3.0 | 6.2 | $0.066 | 0/2 | 25.6s |
| #179 | Gemma 4 31B medium | 2.9 | 6.2 | $0.100 | 0/2 | 433.1s | |
| #180 | GPT-5.6 Luna low | OpenAI | 2.8 | 6.2 | $0.051 | 0/2 | 13.7s |
| #182 | Gemini 3.1 Flash Lite minimal | 3.0 | 6.1 | $0.047 | 0/2 | 7.75s | |
| #183 | Qwen3.5-35B-A3B medium | Qwen | 3.8 | 6.1 | $1.140 | 0/2 | 512.8s |
| #185 | Qwen3.7 Flash none | Qwen | 3.8 | 6.1 | $0.019 | 0/2 | 94.6s |
| #186 | Gemini 3.1 Flash Lite none | 3.0 | 6.1 | $0.046 | 0/2 | 9.49s | |
| #188 | Inkling low | Thinkingmachines | 2.9 | 6.1 | $0.187 | 0/2 | 22.7s |