सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: कुल लागत ↓.
विफलता के कारण
259/259
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #28 | GPT-5.5 medium | OpenAI | 1 | 2.8 | $4.163 | 0/1 | 37.9s |
| #26 | Claude Fable 5.1 high | Anthropic | 1 | 3.0 | $3.364 | 0/1 | 30.6s |
| #95 | Claude Opus 4.6 medium | Anthropic | 1 | 3.0 | $2.961 | 0/1 | 63.2s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 1 | 3.0 | $2.736 | 0/1 | 532.6s |
| #69 | Qwen3.8 2.4T A95B low | Qwen | 1 | 3.0 | $2.672 | 0/1 | 422.5s |
| #150 | Claude Fable 5.1 low | Anthropic | 1 | 3.0 | $2.565 | 0/1 | 19.2s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 1 | 3.0 | $2.357 | 0/1 | 348.0s |
| #73 | Muse Spark 1.1 high | Meta | 1 | 3.0 | $2.253 | 0/1 | 22.9s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 1 | 3.0 | $2.126 | 0/1 | 30.1s |
| #55 | Grok 4.5 medium | X AI | 1 | 3.0 | $2.042 | 0/1 | 74.4s |
| #61 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 3.0 | $1.951 | 0/1 | 91.0s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 3.0 | $1.797 | 0/1 | 78.6s |
| #14 | GPT-6 Astra medium | OpenAI | 1 | 2.8 | $1.774 | 0/1 | 5.98s |
| #45 | Muse Spark 1.2 high | Meta | 1 | 3.0 | $1.771 | 0/1 | 15.0s |
| #76 | GLM 5.2 high | Z.ai | 1 | 3.0 | $1.721 | 0/1 | 127.8s |