कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
197/197
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #96 | Grok 4.6 low | X AI | 2 | 5.5 | $0.449 | 1/3 | 21.7s |
| #97 | Gemini 3 Flash Preview low | 2 | 5.8 | $0.185 | 1/3 | 6.00s | |
| #99 | GLM 5.3 high | Z.ai | 2 | 6.6 | $0.403 | 1/3 | 18.9s |
| #101 | Gemini 3.1 Flash Lite medium | 2 | 5.5 | $0.120 | 1/3 | 3.81s | |
| #102 | Qwen3.7 Plus none | Qwen | 2 | 5.5 | $0.106 | 1/3 | 2.15s |
| #106 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2 | 6.4 | $0.506 | 1/3 | 22.0s |
| #108 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 2 | 6.2 | $0.323 | 1/3 | 125.3s |
| #109 | Qwen3.7 Flash low | Qwen | 2 | 6.7 | $0.043 | 1/3 | 42.4s |
| #116 | GPT-5.6 Sol none | OpenAI | 2 | 5.5 | $0.262 | 1/3 | 1.39s |
| #119 | GPT-5.5 none | OpenAI | 2 | 5.5 | $0.544 | 1/3 | 1.35s |
| #121 | Grok 4.20 medium | X AI | 2 | 6.3 | $0.805 | 1/3 | 109.9s |
| #125 | Qwen3.7 Flash medium | Qwen | 2 | 6.2 | $0.065 | 1/3 | 46.8s |
| #134 | GLM 5.3 low | Z.ai | 2 | 6.2 | $0.257 | 1/3 | 21.0s |
| #136 | Gemini 3 Flash Preview none | 2 | 5.5 | $0.085 | 1/3 | 1.80s | |
| #138 | GLM 5.2 none | Z.ai | 2 | 3.7 | $0.153 | 0/3 | 7.55s |