کوڈنگ: غلط جواب
کوڈنگ
غلط جواب
دیکھیں کہ کوڈنگ میں کن AI ماڈلز کو غلط جواب پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔
ناکامی کی وجوہات
265/265
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | غلط جواب کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #122 | Qwen3.7 Flash low | Qwen | 2 | 0.7 | $0.071 | 1/3 | 42.4s |
| #125 | GPT-6 Luna low | OpenAI | 2 | 0.6 | $0.033 | 1/3 | 15.4s |
| #127 | Space Bunny Alpha high | Stealth | 2 | 0.6 | $0.000 | 1/3 | 8.29s |
| #132 | GPT-5.6 Luna medium | OpenAI | 2 | 0.5 | $0.065 | 1/3 | 10.4s |
| #143 | Claude Fable 5.1 medium | Anthropic | 2 | 0.7 | $3.197 | 1/3 | 11.0s |
| #149 | Qwen3.5-27B none | Qwen | 2 | 0.6 | $0.116 | 1/3 | 1.80s |
| #150 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 2 | 0.7 | $0.567 | 1/3 | 180.7s |
| #152 | Gemini 3.8 Flash low | 2 | 0.5 | $0.323 | 1/3 | 4.31s | |
| #161 | GLM 5.3 FlashX medium | Z.ai | 2 | 0.6 | $0.114 | 1/3 | 6.37s |
| #163 | MiMo-V2.5 medium | Xiaomi | 2 | 0.6 | $0.130 | 1/3 | 97.1s |
| #166 | Gemini 3.1 Flash Lite Preview medium | 2 | 0.5 | $0.158 | 1/3 | 4.09s | |
| #170 | Grok 4.6 low | X AI | 2 | 0.6 | $0.781 | 1/3 | 21.7s |
| #171 | Gemini 3 Flash Preview low | 2 | 0.6 | $0.254 | 1/3 | 6.00s | |
| #173 | Gemini 3.1 Flash Lite medium | 2 | 0.5 | $0.153 | 1/3 | 3.81s | |
| #176 | GPT-5.6 Luna low | OpenAI | 2 | 0.5 | $0.049 | 1/3 | 4.61s |