कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
265/265
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #273 | Seed 2.1 Turbo none | Bytedance Seed | 3 | 0.5 | $0.182 | 0/3 | 2.35s |
| #279 | GLM 5 none | Z.ai | 3 | 0.4 | $0.140 | 0/3 | 5.12s |
| #288 | Seed-2.0-Code none | Bytedance Seed | 3 | 0.4 | $0.257 | 0/3 | 13.4s |
| #291 | North Mini Code medium | Cohere | 3 | 0.4 | $0.000 | 0/3 | 320.4s |
| #297 | GPT-5.6 Luna none | OpenAI | 3 | 0.4 | $0.042 | 0/3 | 980ms |
| #300 | Qwen3.6 Max Preview none | Qwen | 3 | 0.4 | $0.228 | 0/3 | 3.12s |
| #301 | Laguna XS 2.1 none | Poolside | 3 | 0.4 | $0.020 | 0/3 | 623ms |
| #303 | Inkling Small low | Thinkingmachines | 3 | 0.5 | $0.055 | 0/3 | 3.70s |
| #309 | Mistral Small 4 medium | Mistral | 3 | 0.4 | $0.126 | 0/3 | 40.0s |
| #310 | Mistral Small 4 none | Mistral | 3 | 0.4 | $0.047 | 0/3 | 901ms |
| #314 | Apodex 1.1 Mini default | Apodex | 3 | 0.4 | $0.000 | 0/3 | 1.13s |
| #319 | GPT-4o-mini default | OpenAI | 3 | 0.3 | $0.024 | 0/3 | 1.63s |
| #322 | Inkling Small none | Thinkingmachines | 3 | 0.4 | $0.054 | 0/3 | 759ms |
| #323 | Qwen3 Coder Next default | Qwen | 3 | 0.5 | $0.067 | 0/3 | 2.22s |
| #328 | Qwen3.5-9B none | Qwen | 3 | 0.4 | $0.041 | 0/3 | 5.60s |