सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
259/259
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #9 | GPT-6 Astra low | OpenAI | 1 | 3.0 | $1.289 | 0/1 | 4.12s |
| #13 | GPT-5.6 Sol medium | OpenAI | 1 | 4.7 | $0.508 | 0/1 | 4.94s |
| #14 | GPT-6 Astra medium | OpenAI | 1 | 2.8 | $1.774 | 0/1 | 5.98s |
| #15 | GPT-5.6 Sol high | OpenAI | 1 | 4.7 | $0.446 | 0/1 | 6.97s |
| #16 | GPT-5.5 low | OpenAI | 1 | 3.0 | $1.257 | 0/1 | 10.1s |
| #23 | Qwen3.8 Max (0902) low | Qwen | 1 | 3.0 | $0.664 | 0/1 | 13.3s |
| #24 | Seed 2.1 Turbo low | Bytedance Seed | 1 | 3.0 | $1.546 | 0/1 | 171.9s |
| #25 | Qwen3.7 Max medium | Qwen | 1 | 3.0 | $1.157 | 0/1 | 33.4s |
| #26 | Claude Fable 5.1 high | Anthropic | 1 | 3.0 | $3.364 | 0/1 | 30.6s |
| #28 | GPT-5.5 medium | OpenAI | 1 | 2.8 | $4.163 | 0/1 | 37.9s |
| #29 | Qwen3.8 Max medium | Qwen | 1 | 3.0 | $0.771 | 0/1 | 11.5s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 1 | 3.0 | $2.736 | 0/1 | 532.6s |
| #32 | GPT-5.3-Codex medium | OpenAI | 1 | 2.8 | $0.988 | 0/1 | 14.4s |
| #33 | Muse Spark 1.3 high | Meta | 1 | 3.0 | $1.653 | 0/1 | 140.1s |
| #34 | Pareto none | Unbiased | 1 | 2.8 | $1.172 | 0/1 | 32.1s |