पहेली समाधान: गलत उत्तर
पहेली समाधान
गलत उत्तर
देखें कि पहेली समाधान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
145/145
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #101 | GLM 5.2 none | Z.ai | 1 | 7.7 | $0.128 | 2/3 | 3.31s |
| #104 | Gemini 3.5 Flash-Lite medium | 1 | 8.4 | $0.369 | 2/3 | 1.70s | |
| #105 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $0.779 | 2/3 | 61.1s |
| #109 | Qwen3.5-27B none | Qwen | 1 | 6.7 | $0.090 | 1/3 | 1.38s |
| #113 | Qwen3.5 Plus 2026-02-15 none | Qwen | 1 | 7.7 | $0.073 | 2/3 | 2.71s |
| #114 | Ring-2.6-1T medium | Inclusionai | 1 | 5.9 | $0.103 | 1/3 | 20.7s |
| #118 | Claude Sonnet 5 none | Anthropic | 1 | 6.0 | $0.548 | 1/3 | 3.22s |
| #119 | MiMo-V2-Flash medium | Xiaomi | 1 | 7.7 | $0.043 | 2/3 | 3.87s |
| #121 | Gemma 4 31B none | 1 | 6.5 | $0.021 | 1/3 | 4.23s | |
| #123 | GPT-5.6 Luna low | OpenAI | 1 | 7.6 | $0.249 | 2/3 | 3.59s |
| #124 | Gemini 2.5 Flash none | 1 | 7.7 | $0.017 | 2/3 | 604ms | |
| #127 | gpt-oss-120b medium | OpenAI | 1 | 5.3 | $0.019 | 1/3 | 21.7s |
| #128 | Gemini 3.1 Flash Lite none | 1 | 6.3 | $0.046 | 1/3 | 720ms | |
| #129 | Inkling low | Thinkingmachines | 1 | 6.4 | $0.187 | 1/3 | 2.97s |
| #134 | GPT-5 Nano medium | OpenAI | 1 | 5.3 | $0.114 | 1/3 | 20.6s |