पहेली समाधान: गलत उत्तर
पहेली समाधान
गलत उत्तर
देखें कि पहेली समाधान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
145/145
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #135 | Nemotron 3 Ultra none | NVIDIA | 1 | 5.9 | $0.095 | 1/3 | 1.06s |
| #136 | Step 3.5 Flash medium | Stepfun | 1 | 5.3 | $0.108 | 1/3 | 7.22s |
| #140 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 1/3 | 2.38s |
| #142 | GPT-5.4 Mini none | OpenAI | 1 | 5.4 | $0.095 | 1/3 | 836ms |
| #145 | GPT-5.4 none | OpenAI | 1 | 5.6 | $0.397 | 1/3 | 1.44s |
| #147 | GLM 5 none | Z.ai | 1 | 7.7 | $0.041 | 2/3 | 1.91s |
| #151 | GLM 5V Turbo none | Z.ai | 1 | 5.3 | $0.052 | 1/3 | 2.40s |
| #152 | Owl Alpha medium | Openrouter | 1 | 5.3 | $0.000 | 1/3 | 3.40s |
| #153 | Mimo V2 PRO none | Xiaomi | 1 | 6.0 | $0.045 | 1/3 | 1.61s |
| #154 | Owl Alpha none | Openrouter | 1 | 5.4 | $0.000 | 1/3 | 4.18s |
| #156 | DeepSeek V4 Flash none | DeepSeek | 1 | 3.1 | $0.042 | 0/3 | 23.7s |
| #157 | GLM 5.1 none | Z.ai | 1 | 7.7 | $0.164 | 2/3 | 1.45s |
| #158 | Qwen3.6 27B none | Qwen | 1 | 5.3 | $0.087 | 1/3 | 5.15s |
| #159 | Hy3 preview low | Tencent | 1 | 5.3 | $0.015 | 1/3 | 7.51s |
| #160 | MiMo-V2.5-Pro none | Xiaomi | 1 | 6.7 | $0.068 | 1/3 | 1.30s |