स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #52 | DeepSeek V4.1 Flash medium | DeepSeek | 10.0 | 8.7 | $0.182 | 1/1 | 47.6s |
| #256 | Seed 2.1 Turbo none | Bytedance Seed | 5.0 | 5.7 | $0.182 | 0/1 | 71.4s |
| #214 | Gemini 3.5 Flash Lite low | 5.0 | 6.3 | $0.183 | 0/1 | 53.9s | |
| #108 | Qwen3.7 Plus none | Qwen | 10.0 | 7.8 | $0.184 | 1/1 | 143.1s |
| #169 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.8 | $0.184 | 1/1 | 67.7s |
| #93 | GPT-5.4 Nano medium | OpenAI | 10.0 | 8.0 | $0.187 | 1/1 | 74.0s |
| #51 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.7 | $0.190 | 1/1 | 44.0s |
| #239 | MiMo-V2.6-Pro none | Xiaomi | 5.0 | 6.0 | $0.193 | 0/1 | 66.1s |
| #341 | GLM 4.7 Flash medium | Z.ai | 3.9 | 4.2 | $0.193 | 0/1 | 399.2s |
| #247 | Nemotron 3 Ultra none | NVIDIA | 5.0 | 5.9 | $0.193 | 0/1 | 70.2s |
| #151 | MiMo-V2.6-Flash low | Xiaomi | 4.7 | 7.1 | $0.200 | 0/1 | 107.9s |
| #298 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.202 | 0/1 | 198.8s |
| #91 | GPT-5.6 Luna high | OpenAI | 10.0 | 8.0 | $0.207 | 1/1 | 60.2s |
| #126 | GLM 5.3 FlashX high | Z.ai | 10.0 | 7.4 | $0.210 | 1/1 | 78.0s |
| #263 | Qwen3.5-35B-A3B none | Qwen | 3.9 | 5.6 | $0.213 | 0/1 | 141.2s |