স্বায়ত্তশাসিত এজেন্টের কাজ র্যাঙ্কিং
দেখুন স্বায়ত্তশাসিত এজেন্টের কাজ এ কোন AI মডেল সবচেয়ে ভালো করে, কোনগুলো নির্ভরযোগ্য থাকে, আর সবচেয়ে বড় পার্থক্য কোথায় দেখা যায়। সাজান: সঠিক টেস্ট ↑.
387/387
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | স্বায়ত্তশাসিত এজেন্টের কাজ স্কোর | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #310 | Gemini 3 PRO Preview medium | 0.0 | 0.5 | $0.385 | 0/0 | 0ms | |
| #311 | Ling 2.6 1t none | Inclusionai | 0.3 | 0.5 | $0.016 | 0/1 | 38ms |
| #312 | MiMo-V2.5 none | Xiaomi | 0.4 | 0.5 | $0.049 | 0/1 | 124.2s |
| #313 | Qwen3.5-9B none | Qwen | 0.4 | 0.5 | $0.041 | 0/1 | 433.0s |
| #314 | Hy4 preview none | Tencent | 0.5 | 0.5 | $0.179 | 0/1 | 65.5s |
| #315 | Mimo V2 Omni medium | Xiaomi | 0.0 | 0.5 | $0.683 | 0/0 | 0ms |
| #316 | Hy3 preview high | Tencent | 0.0 | 0.5 | $0.135 | 0/0 | 0ms |
| #317 | GLM 4.7 Flash none | Z.ai | 0.5 | 0.5 | $0.027 | 0/1 | 80.7s |
| #318 | Mercury 2.5 Preview none | Inception | 0.4 | 0.5 | $0.023 | 0/1 | 85.0s |
| #319 | Nemotron 3.5 Lightning medium | NVIDIA | 0.3 | 0.5 | $0.195 | 0/1 | 341.8s |
| #320 | North Mini Code none | Cohere | 0.3 | 0.5 | $0.000 | 0/1 | 18.9s |
| #321 | Laguna S 2.1 none | Poolside | 0.5 | 0.5 | $0.044 | 0/1 | 149.3s |
| #322 | Granite 4.2 8B high | IBM Granite | 0.5 | 0.5 | $0.111 | 0/1 | 223.5s |
| #323 | Qwen3 Coder Next medium | Qwen | 0.5 | 0.5 | $0.071 | 0/1 | 151.4s |
| #324 | DeepSeek V3.2 none | DeepSeek | 0.3 | 0.5 | $0.119 | 0/1 | 122.5s |