নির্দেশনা অনুসরণ র্যাঙ্কিং
দেখুন নির্দেশনা অনুসরণ এ কোন AI মডেল সবচেয়ে ভালো করে, কোনগুলো নির্ভরযোগ্য থাকে, আর সবচেয়ে বড় পার্থক্য কোথায় দেখা যায়। সাজান: সঠিক টেস্ট ↑.
316/316
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | নির্দেশনা অনুসরণ স্কোর | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #174 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.4 | $0.228 | 2/2 | 1.40s |
| #178 | MiMo-V2.5 medium | Xiaomi | 9.9 | 6.4 | $0.104 | 2/2 | 1.80s |
| #179 | Ling-3.0-flash high | Inclusionai | 10.0 | 6.4 | $0.021 | 2/2 | 1.85s |
| #180 | Ring-2.6-1T medium | Inclusionai | 9.8 | 6.4 | $0.102 | 2/2 | 11.8s |
| #181 | Mimo V2 PRO medium | Xiaomi | 9.9 | 6.3 | $0.333 | 2/2 | 3.36s |
| #182 | MiMo-V2-Flash medium | Xiaomi | 10.0 | 6.3 | $0.043 | 2/2 | 4.28s |
| #183 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 2/2 | 1.06s |
| #184 | Gemma 4 31B medium | 10.0 | 6.2 | $0.100 | 2/2 | 12.8s | |
| #187 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 2/2 | 932ms | |
| #188 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $0.675 | 2/2 | 24.4s |
| #189 | gpt-oss-120b medium | OpenAI | 9.9 | 6.1 | $0.020 | 2/2 | 7.63s |
| #191 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 2/2 | 859ms | |
| #192 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #193 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #198 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.093 | 2/2 | 1.46s |