অ্যান্টি-এআই কৌশল: ভুল উত্তর
অ্যান্টি-এআই কৌশল
ভুল উত্তর
দেখুন অ্যান্টি-এআই কৌশল এ কোন AI মডেলগুলোর ভুল উত্তর হওয়ার সম্ভাবনা সবচেয়ে বেশি, যাতে দুর্বল দিক দ্রুত ধরা যায়।
ব্যর্থতার কারণ
188/188
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | ভুল উত্তর সংখ্যা | বিভাগ স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #178 | Seed-2.0-Lite none | Bytedance Seed | 4 | 3.0 | $0.066 | 0/4 | 2.43s |
| #185 | Qwen3.7 Flash none | Qwen | 4 | 3.0 | $0.019 | 0/4 | 2.55s |
| #190 | Qwen3.6 Flash none | Qwen | 4 | 3.1 | $0.062 | 0/4 | 1.63s |
| #193 | Nemotron 3 Ultra none | NVIDIA | 4 | 3.5 | $0.084 | 0/4 | 2.35s |
| #195 | Gemini 2.5 Flash none | 4 | 3.0 | $0.017 | 0/4 | 582ms | |
| #200 | Qwen3.5-Flash none | Qwen | 4 | 3.5 | $0.073 | 0/4 | 1.32s |
| #201 | Qwen3.5-35B-A3B none | Qwen | 4 | 3.4 | $0.142 | 0/4 | 1.43s |
| #207 | GPT-5.4 Mini none | OpenAI | 4 | 3.1 | $0.095 | 0/4 | 929ms |
| #209 | GPT-5.4 none | OpenAI | 4 | 3.2 | $0.397 | 0/4 | 1.21s |
| #216 | GLM 5.1 none | Z.ai | 4 | 4.0 | $0.164 | 0/4 | 2.11s |
| #224 | Mimo V2 PRO none | Xiaomi | 4 | 3.5 | $0.045 | 0/4 | 1.80s |
| #229 | Qwen3.6 27B none | Qwen | 4 | 3.8 | $0.116 | 0/4 | 2.83s |
| #233 | DeepSeek V4 Flash 0423 none | DeepSeek | 4 | 3.0 | $0.037 | 0/4 | 20.2s |
| #238 | Kimi K2.5 none | Moonshot AI | 4 | 3.6 | $0.101 | 0/4 | 6.24s |
| #241 | Inkling Small none | Thinkingmachines | 4 | 3.1 | $0.054 | 0/4 | 526ms |