सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
197/197
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #46 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 3.0 | $0.079 | 0/1 | 110.6s |
| #47 | Inkling medium | Thinkingmachines | 1 | 2.8 | $0.391 | 0/1 | 21.7s |
| #49 | GPT-5.6 Terra high | OpenAI | 1 | 3.0 | $0.422 | 0/1 | 23.3s |
| #50 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 3.0 | $0.234 | 0/1 | 48.3s |
| #51 | Qwen3.7 Plus medium | Qwen | 1 | 3.0 | $0.267 | 0/1 | 91.1s |
| #52 | Qwen3.6 Plus medium | Qwen | 1 | 3.0 | $0.405 | 0/1 | 47.5s |
| #53 | Gemini 3.5 Flash Lite medium | 1 | 2.8 | $0.273 | 0/1 | 3.75s | |
| #55 | GPT-5.6 Terra medium | OpenAI | 1 | 3.0 | $0.271 | 0/1 | 10.1s |
| #56 | Claude Sonnet 4.6 medium | Anthropic | 1 | 3.0 | $2.057 | 0/1 | 30.1s |
| #57 | Qwen3.7 Flash high | Qwen | 1 | 3.0 | $0.051 | 0/1 | 17.7s |
| #59 | GLM 5 medium | Z.ai | 1 | 3.0 | $0.307 | 0/1 | 67.4s |
| #60 | Claude Opus 4.6 medium | Anthropic | 1 | 3.0 | $3.059 | 0/1 | 63.2s |
| #61 | GPT-5.6 Luna high | OpenAI | 1 | 3.0 | $0.102 | 0/1 | 17.0s |
| #62 | DeepSeek V4 Flash high | DeepSeek | 1 | 3.0 | $0.060 | 0/1 | 54.5s |
| #63 | DeepSeek V4 Pro high | DeepSeek | 1 | 3.0 | $0.200 | 0/1 | 34.0s |