ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #50 | Grok 4.6 medium | X AI | 10.0 | 8.4 | $1.713 | 2/2 | 62.7s |
| #64 | Inkling high | Thinkingmachines | 7.3 | 8.0 | $1.046 | 1/2 | 63.8s |
| #114 | GLM 5.3 high | Z.ai | 6.4 | 7.3 | $0.403 | 1/2 | 64.0s |
| #3 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $3.803 | 2/2 | 64.0s |
| #181 | Mimo V2 PRO medium | Xiaomi | 2.3 | 6.3 | $0.333 | 0/1 | 64.7s |
| #169 | Qwen3.5 Plus 2026-02-15 none | Qwen | 6.5 | 6.6 | $0.073 | 1/2 | 64.8s |
| #103 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 2/2 | 65.1s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 2/2 | 65.1s | |
| #107 | Kimi K2.7 Code medium | Moonshot AI | 7.3 | 7.4 | $0.687 | 1/2 | 66.0s |
| #129 | Step 3.7 Flash low | Stepfun | 7.3 | 7.1 | $0.390 | 1/2 | 66.2s |
| #65 | Muse Spark 1.1 high | Meta | 5.9 | 8.0 | $2.253 | 0/2 | 70.3s |
| #150 | DeepSeek V4 Pro none | DeepSeek | 7.9 | 6.8 | $0.220 | 1/2 | 71.6s |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 72.1s |
| #279 | KAT-Coder-Air V2.5 none | Kwaipilot | 3.8 | 4.8 | $0.070 | 0/2 | 73.0s |
| #225 | KAT-Coder-Air V2.5 high | Kwaipilot | 6.5 | 5.6 | $0.077 | 1/2 | 74.5s |