কোডিং: ভুল উত্তর
কোডিং
ভুল উত্তর
দেখুন কোডিং এ কোন AI মডেলগুলোর ভুল উত্তর হওয়ার সম্ভাবনা সবচেয়ে বেশি, যাতে দুর্বল দিক দ্রুত ধরা যায়।
ব্যর্থতার কারণ
197/197
মডেল ফিল্টার করুন
বর্তমান অনুসন্ধান ও ফিল্টারের সাথে কোনো মডেল মেলেনি।
| র্যাঙ্ক | মডেল | কোম্পানি | ভুল উত্তর সংখ্যা | বিভাগ স্কোর | মোট খরচ | সঠিক টেস্ট | প্রতিক্রিয়া সময় (গড়) |
|---|---|---|---|---|---|---|---|
| #96 | Grok 4.6 low | X AI | 2 | 5.5 | $0.449 | 1/3 | 21.7s |
| #97 | Gemini 3 Flash Preview low | 2 | 5.8 | $0.185 | 1/3 | 6.00s | |
| #99 | GLM 5.3 high | Z.ai | 2 | 6.6 | $0.403 | 1/3 | 18.9s |
| #101 | Gemini 3.1 Flash Lite medium | 2 | 5.5 | $0.120 | 1/3 | 3.81s | |
| #102 | Qwen3.7 Plus none | Qwen | 2 | 5.5 | $0.106 | 1/3 | 2.15s |
| #106 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2 | 6.4 | $0.506 | 1/3 | 22.0s |
| #108 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 2 | 6.2 | $0.323 | 1/3 | 125.3s |
| #109 | Qwen3.7 Flash low | Qwen | 2 | 6.7 | $0.043 | 1/3 | 42.4s |
| #116 | GPT-5.6 Sol none | OpenAI | 2 | 5.5 | $0.262 | 1/3 | 1.39s |
| #119 | GPT-5.5 none | OpenAI | 2 | 5.5 | $0.544 | 1/3 | 1.35s |
| #121 | Grok 4.20 medium | X AI | 2 | 6.3 | $0.805 | 1/3 | 109.9s |
| #125 | Qwen3.7 Flash medium | Qwen | 2 | 6.2 | $0.065 | 1/3 | 46.8s |
| #134 | GLM 5.3 low | Z.ai | 2 | 6.2 | $0.257 | 1/3 | 21.0s |
| #136 | Gemini 3 Flash Preview none | 2 | 5.5 | $0.085 | 1/3 | 1.80s | |
| #138 | GLM 5.2 none | Z.ai | 2 | 3.7 | $0.153 | 0/3 | 7.55s |