ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات.
311/311
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #98 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 2/2 | 65.1s |
| #103 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 2/2 | 14.6s |
| #113 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 2/2 | 117.7s |
| #136 | Claude Fable 5.1 low | Anthropic | 10.0 | 6.9 | $2.565 | 2/2 | 29.4s |
| #152 | LongCat 2.0 low | Meituan | 10.0 | 6.7 | $0.412 | 2/2 | 130.2s |
| #155 | LongCat 2.0 high | Meituan | 10.0 | 6.7 | $0.492 | 2/2 | 167.1s |
| #30 | Gemini 3.5 Flash Lite high | 9.9 | 8.8 | $0.540 | 2/2 | 27.9s | |
| #31 | Claude Opus 4.8 medium | Anthropic | 9.9 | 8.8 | $1.983 | 2/2 | 54.3s |
| #50 | Inkling Small high | Thinkingmachines | 9.9 | 8.4 | $0.398 | 2/2 | 40.4s |
| #78 | Claude Opus 4.8 low | Anthropic | 9.9 | 7.8 | $2.089 | 2/2 | 36.9s |
| #90 | GPT-5.4 Nano medium | OpenAI | 9.9 | 7.5 | $0.142 | 2/2 | 32.2s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 9.9 | 5.9 | $0.000 | 2/2 | 60.8s |
| #44 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 17.0s |
| #61 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.8 | 8.0 | $0.044 | 2/2 | 54.2s |
| #13 | Gemini 3.1 Pro Preview medium | 9.8 | 9.2 | $1.352 | 2/2 | 40.4s |