কোন উত্তর নেই ব্যর্থতা
দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি কোন উত্তর নেই সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন। সাজান: সঠিক টেস্ট ↑.
119/119
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | কোন উত্তর নেই সংখ্যা | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #170 | Qwen3.6 27B medium | Qwen | 3 | 6.5 | $0.577 | 10/22 | 106.1s |
| #175 | Dots 3 Note Preview low | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 61.8s |
| #176 | Dots 3 Note Preview high | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 67.8s |
| #187 | Gemini 3.1 Flash Lite minimal | 1 | 6.1 | $0.047 | 10/22 | 1.85s | |
| #213 | Seed 2.1 Turbo none | Bytedance Seed | 1 | 5.9 | $0.092 | 10/22 | 6.84s |
| #283 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #284 | Laguna M.1 medium | Poolside | 1 | 4.7 | $0.033 | 9/19 | 14.7s |
| #207 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #209 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #97 | MiniMax M3 medium | Minimax | 1 | 7.5 | $0.300 | 11/22 | 75.2s |
| #119 | DeepSeek V4 Flash 0731 medium | DeepSeek | 3 | 7.3 | $0.066 | 11/22 | 84.7s |
| #126 | Muse Glimmer 30B medium | Meta | 1 | 7.2 | $0.211 | 11/22 | 30.6s |
| #128 | Muse Glimmer 30B low | Meta | 1 | 7.1 | $0.143 | 11/22 | 18.6s |
| #129 | Step 3.7 Flash low | Stepfun | 1 | 7.1 | $0.390 | 11/22 | 17.9s |
| #130 | Solar Pro 4 high | Upstage | 1 | 7.1 | $0.046 | 11/22 | 120.6s |