ترتيب مهام الوكلاء
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مهام الوكلاء، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: المقياس ↑.
380/380
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مهام الوكلاء | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #322 | Gemini 3.1 Flash Lite high | 0.0 | 4.6 | $2.044 | 0/0 | 0ms | |
| #323 | GLM 5V Turbo none | Z.ai | 0.0 | 4.6 | $0.052 | 0/0 | 0ms |
| #326 | Owl Alpha medium | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #327 | Mimo V2 PRO none | Xiaomi | 0.0 | 4.6 | $0.045 | 0/0 | 0ms |
| #328 | Owl Alpha none | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #330 | Hy3 preview low | Tencent | 0.0 | 4.5 | $0.042 | 0/0 | 0ms |
| #332 | Mimo V2 Omni none | Xiaomi | 0.0 | 4.5 | $0.021 | 0/0 | 0ms |
| #339 | Gemini 3.1 Flash Lite Preview high | 0.0 | 4.3 | $2.310 | 0/0 | 0ms | |
| #343 | GLM 5 Turbo none | Z.ai | 0.0 | 4.2 | $0.047 | 0/0 | 0ms |
| #345 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 4.0 | $0.000 | 0/0 | 0ms |
| #347 | Grok 4.20 Multi Agent Beta medium | X AI | 0.0 | 3.9 | $5.599 | 0/0 | 0ms |
| #348 | Hunter Alpha medium | OpenRouter | 0.0 | 3.9 | $0.000 | 0/0 | 0ms |
| #349 | Grok 4.1 Fast medium | X AI | 0.0 | 3.9 | $0.069 | 0/0 | 0ms |
| #350 | Laguna M.1 medium | Poolside | 0.0 | 3.9 | $0.033 | 0/0 | 0ms |
| #357 | Grok 4.20 Beta none | X AI | 0.0 | 3.6 | $0.087 | 0/0 | 0ms |