ترتيب مهام الوكلاء
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مهام الوكلاء، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: إجمالي التكلفة ↑.
380/380
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مهام الوكلاء | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #5 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $5.044 | 1/1 | 69.6s |
| #45 | Claude Fable 5 medium | Anthropic | 10.0 | 8.9 | $5.089 | 1/1 | 57.1s |
| #347 | Grok 4.20 Multi Agent Beta medium | X AI | 0.0 | 3.9 | $5.599 | 0/0 | 0ms |
| #8 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $6.213 | 1/1 | 56.7s |
| #29 | Claude Sonnet 5.5 max | Anthropic | 10.0 | 9.2 | $8.557 | 1/1 | 111.1s |