कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
265/265
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #259 | Gemini 3.1 Flash Lite none | 2 | 0.5 | $0.069 | 1/3 | 938ms | |
| #260 | Qwen3.6 Flash none | Qwen | 2 | 0.5 | $0.139 | 1/3 | 1.79s |
| #262 | Nemotron 3 Ultra none | NVIDIA | 2 | 0.5 | $0.164 | 1/3 | 1.02s |
| #263 | Qwen3.7 Flash none | Qwen | 2 | 0.5 | $0.028 | 1/3 | 1.55s |
| #264 | Qwen3.8 Flash Next none | Qwen | 2 | 0.5 | ~$0.011 | 1/3 | 1.64s |
| #265 | GPT-5.6 Terra none | OpenAI | 2 | 0.5 | $0.377 | 1/3 | 1.00s |
| #267 | Ling 3.0 Flash high | Inclusionai | 2 | 0.7 | $0.021 | 1/3 | 14.9s |
| #270 | GPT-5 Nano medium | OpenAI | 2 | 0.7 | $0.159 | 1/3 | 41.6s |
| #271 | GPT-5.4 Mini none | OpenAI | 2 | 0.5 | $0.170 | 1/3 | 913ms |
| #275 | Gemma 4 31B none | 2 | 0.5 | $0.031 | 1/3 | 11.2s | |
| #276 | Space Bunny Alpha low | Stealth | 2 | 0.6 | $0.000 | 1/3 | 6.60s |
| #277 | GPT-5.4 none | OpenAI | 2 | 0.5 | $0.690 | 1/3 | 1.62s |
| #278 | Solar Pro 4 none | Upstage | 2 | 0.5 | $0.022 | 1/3 | 2.61s |
| #280 | Qwen3.5-35B-A3B none | Qwen | 2 | 0.5 | $0.120 | 1/3 | 1.39s |
| #284 | Gemini 2.5 Flash none | 2 | 0.5 | $0.017 | 1/3 | 736ms |