सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
197/197
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #166 | GPT-5.4 none | OpenAI | 1 | 3.0 | $0.397 | 0/1 | 990ms |
| #167 | Nemotron 3 Super medium | NVIDIA | 1 | 3.0 | $0.050 | 0/1 | 55.3s |
| #168 | GLM 5 none | Z.ai | 1 | 3.0 | $0.041 | 0/1 | 3.62s |
| #169 | Inkling Small low | Thinkingmachines | 1 | 3.0 | $0.059 | 0/1 | 2.00s |
| #170 | Ling 3.0 Flash none | Inclusionai | 1 | 3.0 | $0.000 | 0/1 | 10.6s |
| #171 | Qwen3.5-122B-A10B none | Qwen | 1 | 3.0 | $0.247 | 0/1 | 295ms |
| #173 | KAT-Coder-Air V2.5 high | Kwaipilot | 1 | 3.0 | $0.077 | 0/1 | 21.7s |
| #174 | GLM 5V Turbo none | Z.ai | 1 | 3.0 | $0.052 | 0/1 | 2.23s |
| #175 | Owl Alpha medium | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 2.38s |
| #176 | Mimo V2 PRO none | Xiaomi | 1 | 3.0 | $0.045 | 0/1 | 1.63s |
| #177 | Owl Alpha none | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 2.50s |
| #178 | KAT-Coder-Air V2.5 medium | Kwaipilot | 1 | 3.0 | $0.048 | 0/1 | 15.7s |
| #179 | DeepSeek V4 Flash none | DeepSeek | 1 | 3.0 | $0.062 | 0/1 | 3.07s |
| #180 | GLM 5.1 none | Z.ai | 1 | 3.0 | $0.162 | 0/1 | 2.34s |
| #181 | Qwen3.6 27B none | Qwen | 1 | 3.0 | $0.067 | 0/1 | 4.03s |