कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
265/265
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #285 | GPT-6 Luna none | OpenAI | 2 | 0.5 | $0.026 | 1/3 | 8.04s |
| #286 | Gemma 4 26B A4B none | 2 | 0.4 | $0.031 | 0/3 | 4.16s | |
| #287 | GLM 5V Turbo medium | Z.ai | 2 | 0.6 | $0.457 | 1/3 | 63.4s |
| #290 | Qwen3.8 27B none | Qwen | 2 | 0.5 | ~$0.010 | 1/3 | 1.19s |
| #292 | Hy4 preview low | Tencent | 2 | 0.5 | $1.844 | 0/3 | 219.1s |
| #293 | MiMo-V2.6-Flash none | Xiaomi | 2 | 0.4 | $0.060 | 0/3 | 744ms |
| #295 | Ember-1 none | Fireworks | 2 | 0.5 | $0.786 | 1/3 | 1.94s |
| #298 | Granite 4.2 8B low | IBM Granite | 2 | 0.5 | $0.036 | 1/3 | 13.0s |
| #299 | Kimi K2.5 none | Moonshot AI | 2 | 0.5 | $0.262 | 1/3 | 24.6s |
| #302 | Qwen3.6 35B A3B none | Qwen | 2 | 0.5 | $0.105 | 1/3 | 8.77s |
| #304 | Ling 3.0 Flash none | Inclusionai | 2 | 0.5 | $0.004 | 1/3 | 6.39s |
| #305 | Nemotron 3.5 Lightning high | NVIDIA | 2 | 0.4 | $0.168 | 0/3 | 168.4s |
| #311 | Mercury 2.5 low | Inception | 2 | 0.5 | $0.020 | 1/3 | 972ms |
| #312 | KAT Coder AIR V2.5 medium | Kwaipilot | 2 | 0.4 | $0.048 | 0/3 | 23.4s |
| #313 | MiMo-V2.5-Pro none | Xiaomi | 2 | 0.4 | $0.135 | 0/3 | 1.41s |