स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #322 | Gemini 3.1 Flash Lite high | 0.0 | 4.6 | $2.044 | 0/0 | 0ms | |
| #323 | GLM 5V Turbo none | Z.ai | 0.0 | 4.6 | $0.052 | 0/0 | 0ms |
| #326 | Owl Alpha medium | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #327 | Mimo V2 PRO none | Xiaomi | 0.0 | 4.6 | $0.045 | 0/0 | 0ms |
| #328 | Owl Alpha none | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #330 | Hy3 preview low | Tencent | 0.0 | 4.5 | $0.042 | 0/0 | 0ms |
| #332 | Mimo V2 Omni none | Xiaomi | 0.0 | 4.5 | $0.021 | 0/0 | 0ms |
| #339 | Gemini 3.1 Flash Lite Preview high | 0.0 | 4.3 | $2.310 | 0/0 | 0ms | |
| #343 | GLM 5 Turbo none | Z.ai | 0.0 | 4.2 | $0.047 | 0/0 | 0ms |
| #345 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 4.0 | $0.000 | 0/0 | 0ms |
| #347 | Grok 4.20 Multi Agent Beta medium | X AI | 0.0 | 3.9 | $5.599 | 0/0 | 0ms |
| #348 | Hunter Alpha medium | OpenRouter | 0.0 | 3.9 | $0.000 | 0/0 | 0ms |
| #349 | Grok 4.1 Fast medium | X AI | 0.0 | 3.9 | $0.069 | 0/0 | 0ms |
| #350 | Laguna M.1 medium | Poolside | 0.0 | 3.9 | $0.033 | 0/0 | 0ms |
| #357 | Grok 4.20 Beta none | X AI | 0.0 | 3.6 | $0.087 | 0/0 | 0ms |