कोडिंग: गलत उत्तर
कोडिंग
गलत उत्तर
देखें कि कोडिंग में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↑.
विफलता के कारण
265/265
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #128 | GLM 5.1 medium | Z.ai | 1 | 0.5 | $1.546 | 0/3 | 109.6s |
| #133 | Qwen3.6 Flash medium | Qwen | 3 | 0.5 | $0.783 | 0/3 | 42.9s |
| #175 | Gemma 4 31B medium | 1 | 0.4 | $0.144 | 0/3 | 219.8s | |
| #180 | Qwen3.5-Flash medium | Qwen | 2 | 0.4 | $0.184 | 0/3 | 58.9s |
| #181 | Inkling low | Thinkingmachines | 3 | 0.5 | $0.293 | 0/3 | 8.71s |
| #195 | Apodex 1.1 Mini high | Apodex | 3 | 0.6 | $0.000 | 0/3 | 47.0s |
| #198 | GLM 5.2 none | Z.ai | 2 | 0.4 | $0.250 | 0/3 | 7.55s |
| #202 | Step 3.7 Flash high | Stepfun | 1 | 0.4 | $1.478 | 0/3 | 206.2s |
| #209 | GLM 5.1 none | Z.ai | 3 | 0.4 | $0.451 | 0/3 | 4.96s |
| #213 | Qwen3.5-122B-A10B none | Qwen | 3 | 0.4 | $0.308 | 0/3 | 2.77s |
| #218 | Mercury 2.5 medium | Inception | 3 | 0.5 | $0.034 | 0/3 | 3.70s |
| #226 | Gemini 3.5 Flash Lite low | 3 | 0.4 | $0.183 | 0/3 | 917ms | |
| #230 | Qwen3.5 Plus 2026-02-15 none | Qwen | 3 | 0.4 | $0.176 | 0/3 | 2.05s |
| #236 | DeepSeek V4 Flash 0423 none | DeepSeek | 3 | 0.4 | $0.149 | 0/3 | 17.1s |
| #241 | DeepSeek V4 Flash 0731 none | DeepSeek | 3 | 0.4 | $0.053 | 0/3 | 1.72s |