স্বায়ত্তশাসিত এজেন্টের কাজ র্যাঙ্কিং
দেখুন স্বায়ত্তশাসিত এজেন্টের কাজ এ কোন AI মডেল সবচেয়ে ভালো করে, কোনগুলো নির্ভরযোগ্য থাকে, আর সবচেয়ে বড় পার্থক্য কোথায় দেখা যায়। সাজান: প্রতিক্রিয়া সময় (গড়) ↓.
380/380
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | স্বায়ত্তশাসিত এজেন্টের কাজ স্কোর | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #210 | Dots 3 Note Preview high | Dots Studio | 6.1 | 6.4 | $0.000 | 0/1 | 129.1s |
| #372 | Command A+ low | Cohere | 2.8 | 3.0 | $0.073 | 0/1 | 128.5s |
| #224 | Grok 4.20 medium | X AI | 3.0 | 6.3 | $1.582 | 0/1 | 128.3s |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 9.0 | $1.096 | 1/1 | 127.5s |
| #100 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.9 | $2.805 | 1/1 | 127.1s |
| #213 | Qwen3.5-35B-A3B medium | Qwen | 7.4 | 6.3 | $1.249 | 0/1 | 126.8s |
| #139 | Qwen3.5-27B none | Qwen | 10.0 | 7.2 | $0.116 | 1/1 | 124.5s |
| #308 | MiMo-V2.5 none | Xiaomi | 3.9 | 4.9 | $0.063 | 0/1 | 124.2s |
| #320 | DeepSeek V3.2 none | DeepSeek | 3.0 | 4.6 | $0.121 | 0/1 | 122.5s |
| #157 | Ember-1 low | Fireworks | 4.7 | 7.0 | $1.488 | 0/1 | 121.3s |
| #248 | Qwen3.7 Flash none | Qwen | 4.7 | 5.9 | $0.028 | 0/1 | 117.0s |
| #180 | MiniMax M3 medium | Minimax | 3.0 | 6.7 | $0.372 | 0/1 | 116.5s |
| #136 | LongCat 2.0 high | Meituan | 10.0 | 7.3 | $0.569 | 1/1 | 116.1s |
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.927 | 1/1 | 115.5s | |
| #30 | Qwen3.8 MAX medium | Qwen | 10.0 | 9.2 | $0.948 | 1/1 | 115.3s |