पहेली समाधान: गलत उत्तर
पहेली समाधान
गलत उत्तर
देखें कि पहेली समाधान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
142/142
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #164 | Inkling none | Thinkingmachines | 1 | 5.6 | $0.147 | 1/3 | 931ms |
| #168 | MiMo-V2.5 none | Xiaomi | 1 | 5.4 | $0.025 | 1/3 | 2.13s |
| #170 | GLM 5 Turbo none | Z.ai | 1 | 5.5 | $0.047 | 1/3 | 2.65s |
| #171 | North Mini Code none | Cohere | 1 | 3.5 | $0.000 | 0/3 | 24.4s |
| #172 | MiniMax M2.7 medium | Minimax | 1 | 5.9 | $0.163 | 1/3 | 24.9s |
| #176 | GLM 4.7 Flash none | Z.ai | 1 | 6.4 | $0.016 | 1/3 | 1.20s |
| #177 | Nemotron 3 Super none | NVIDIA | 1 | 5.5 | $0.008 | 1/3 | 2.36s |
| #180 | GPT-5.4 Nano none | OpenAI | 1 | 5.4 | $0.041 | 1/3 | 1.25s |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 1 | 6.7 | $5.599 | 1/3 | 5.19s |
| #184 | Hunter Alpha medium | OpenRouter | 1 | 6.1 | $0.000 | 1/3 | 5.35s |
| #185 | Grok 4.1 Fast medium | X AI | 1 | 5.3 | $0.069 | 1/3 | 7.40s |
| #186 | Laguna M.1 medium | Poolside | 1 | 5.3 | $0.033 | 1/3 | 10.2s |
| #190 | MiniMax M2.5 medium | Minimax | 1 | 5.3 | $0.340 | 1/3 | 11.2s |
| #191 | Grok 4.20 Beta none | X AI | 1 | 7.7 | $0.087 | 2/3 | 586ms |
| #195 | Elephant Alpha medium | Openrouter | 1 | 5.3 | $0.000 | 1/3 | 868ms |