ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: اختبارات صحيحة ↓.
216/216
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #140 | Mimo V2 Omni medium | Xiaomi | 5.0 | 5.9 | $0.683 | 1/1 | 25.9s |
| #141 | Hy3 preview high | Tencent | 5.0 | 5.9 | $0.048 | 1/1 | 113.1s |
| #149 | Gemini 3.1 Flash Lite high | 5.0 | 5.6 | $2.044 | 1/1 | 149.2s | |
| #159 | Hy3 preview low | Tencent | 5.0 | 5.5 | $0.015 | 1/1 | 78.7s |
| #169 | Gemini 3.1 Flash Lite Preview high | 5.0 | 5.3 | $2.310 | 1/1 | 280.5s | |
| #181 | Qwen3.6 Plus Preview medium | Qwen | 5.0 | 4.9 | $0.000 | 1/1 | 35.0s |
| #191 | Grok 4.1 Fast medium | X AI | 5.0 | 4.7 | $0.069 | 1/1 | 37.6s |
| #4 | Gemini 3.5 Flash high | 8.2 | 9.5 | $1.976 | 1/2 | 84.1s | |
| #11 | Qwen3.7 Max medium | Qwen | 8.7 | 9.2 | $1.116 | 1/2 | 287.8s |
| #14 | Gemini 3.5 Flash low | 8.2 | 8.9 | $0.433 | 1/2 | 30.0s | |
| #19 | Muse Spark 1.1 medium | Meta | 8.3 | 8.6 | $1.357 | 1/2 | 42.6s |
| #20 | Claude Fable 5 medium | Anthropic | 6.5 | 8.6 | $3.478 | 1/2 | 27.5s |
| #22 | Qwen3.6 Max Preview medium | Qwen | 7.3 | 8.4 | $1.143 | 1/2 | 177.5s |
| #23 | Grok 4.5 low | X AI | 6.5 | 8.4 | $0.935 | 1/2 | 12.8s |
| #26 | Claude Sonnet 5 medium | Anthropic | 7.3 | 8.3 | $0.922 | 1/2 | 51.9s |