कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
265/265
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #77 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 0.6 | $0.576 | 1/3 | 252.7s |
| #79 | GPT-5.6 Terra high | OpenAI | 1 | 0.8 | $0.698 | 2/3 | 9.14s |
| #88 | GLM 5.2 medium | Z.ai | 1 | 0.8 | $1.007 | 2/3 | 41.0s |
| #90 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 0.8 | $0.271 | 2/3 | 156.7s |
| #93 | Claude Opus 4.7 medium | Anthropic | 1 | 0.8 | $3.636 | 2/3 | 13.0s |
| #94 | DeepSeek V4 Flash 0423 high | DeepSeek | 1 | 0.8 | $0.261 | 2/3 | 50.6s |
| #97 | Nemotron 3 Ultra medium | NVIDIA | 1 | 0.8 | $0.674 | 2/3 | 26.5s |
| #99 | Gemini 3.8 Flash medium | 1 | 0.8 | $0.769 | 2/3 | 11.7s | |
| #103 | GLM 5.3 FlashX max | Z.ai | 1 | 0.8 | $0.623 | 2/3 | 24.6s |
| #104 | Claude Fable 5.1 high | Anthropic | 1 | 0.8 | $3.471 | 2/3 | 13.9s |
| #105 | GPT-5.4 Mini medium | OpenAI | 1 | 0.8 | $1.102 | 2/3 | 57.9s |
| #109 | MiMo-V2.6-Flash medium | Xiaomi | 1 | 0.7 | $0.218 | 1/3 | 18.2s |
| #111 | Grok 4.5 medium | X AI | 1 | 0.8 | $2.996 | 2/3 | 155.7s |
| #113 | Step 3.7 Flash medium | Stepfun | 1 | 0.9 | $0.571 | 2/3 | 27.4s |
| #114 | Grok 4.6 medium | X AI | 1 | 0.8 | $2.270 | 2/3 | 120.0s |