কোন উত্তর নেই ব্যর্থতা
দেখুন কোন AI মডেলগুলো সবচেয়ে বেশি কোন উত্তর নেই সমস্যায় পড়ে, যাতে বেছে নেওয়ার আগে নির্ভরযোগ্যতার ঝুঁকি বুঝতে পারেন।
119/119
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | কোন উত্তর নেই সংখ্যা | স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #178 | MiMo-V2.5 medium | Xiaomi | 2 | 6.4 | $0.104 | 11/22 | 46.3s |
| #186 | Claude Sonnet 5 none | Anthropic | 2 | 6.1 | $0.548 | 7/22 | 6.05s |
| #208 | Dots 3 Note Preview medium | Dots Studio | 2 | 5.9 | $0.000 | 8/22 | 67.1s |
| #209 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #239 | Laguna S 2.1 medium | Poolside | 2 | 5.4 | $0.053 | 4/22 | 58.4s |
| #245 | Laguna S 2.1 high | Poolside | 2 | 5.4 | $0.114 | 4/22 | 111.6s |
| #264 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #289 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |
| #299 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #2 | Gemini 3.8 Flash high | 1 | 9.9 | $1.595 | 21/22 | 37.2s | |
| #17 | Grok 4.6 high | X AI | 1 | 9.3 | $1.908 | 19/22 | 84.1s |
| #20 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #21 | Claude Opus 5 medium | Anthropic | 1 | 9.2 | $1.586 | 18/22 | 10.3s |
| #31 | Muse Spark 1.3 high | Meta | 1 | 8.9 | $1.653 | 16/22 | 52.5s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 8.9 | $1.797 | 16/22 | 174.0s |