স্বায়ত্তশাসিত এজেন্টের কাজ র্যাঙ্কিং
দেখুন স্বায়ত্তশাসিত এজেন্টের কাজ এ কোন AI মডেল সবচেয়ে ভালো করে, কোনগুলো নির্ভরযোগ্য থাকে, আর সবচেয়ে বড় পার্থক্য কোথায় দেখা যায়।
380/380
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | স্বায়ত্তশাসিত এজেন্টের কাজ স্কোর | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #152 | MiMo-V2.5 medium | Xiaomi | 10.0 | 7.1 | $0.419 | 1/1 | 113.6s |
| #165 | Gemma 4 31B medium | 10.0 | 6.9 | $0.117 | 1/1 | 82.1s | |
| #166 | GPT-5.6 Luna low | OpenAI | 10.0 | 6.9 | $0.075 | 1/1 | 45.7s |
| #167 | Claude Sonnet 5.5 low | Anthropic | 10.0 | 6.9 | $0.909 | 1/1 | 46.6s |
| #169 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.8 | $0.184 | 1/1 | 67.7s |
| #170 | Inkling low | Thinkingmachines | 10.0 | 6.8 | $0.304 | 1/1 | 44.2s |
| #177 | Qwen3.5-Flash none | Qwen | 10.0 | 6.7 | $0.089 | 1/1 | 53.8s |
| #181 | Ember-1 max | Fireworks | 10.0 | 6.7 | $3.264 | 1/1 | 62.5s |
| #184 | GLM 5.3 Flash low | Z.ai | 10.0 | 6.6 | $0.052 | 1/1 | 59.7s |
| #191 | Claude Sonnet 5.5 medium | Anthropic | 10.0 | 6.5 | $1.100 | 1/1 | 51.2s |
| #196 | GLM 5.1 none | Z.ai | 10.0 | 6.5 | $0.311 | 1/1 | 107.2s |
| #201 | Qwen3.5-122B-A10B none | Qwen | 10.0 | 6.4 | $0.308 | 1/1 | 55.9s |
| #214 | Qwen3.6 27B none | Qwen | 10.0 | 6.3 | $0.147 | 1/1 | 58.6s |
| #223 | DeepSeek V4 Flash 0423 none | DeepSeek | 10.0 | 6.3 | $0.050 | 1/1 | 92.9s |
| #229 | DeepSeek V4 Flash 0731 none | DeepSeek | 10.0 | 6.2 | $0.055 | 1/1 | 174.9s |