सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
259/259
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #295 | Grok 4.1 Fast medium | X AI | 1 | 3.0 | $0.069 | 0/1 | 25.5s |
| #297 | Cobuddy medium | Baidu | 1 | 3.0 | $0.000 | 0/1 | 37.0s |
| #298 | Mercury 2 none | Inception | 1 | 3.0 | $0.030 | 0/1 | 548ms |
| #299 | Granite 4.2 8B high | IBM Granite | 1 | 3.0 | $0.135 | 0/1 | 252.5s |
| #300 | Qwen3 Coder Next medium | Qwen | 1 | 3.0 | $0.034 | 0/1 | 399ms |
| #301 | MiniMax M2.5 medium | Minimax | 1 | 3.0 | $0.327 | 0/1 | 80.8s |
| #302 | Laguna S 2.1 none | Poolside | 1 | 3.0 | $0.022 | 0/1 | 200.5s |
| #306 | GLM 4.7 Flash medium | Z.ai | 1 | 3.0 | $0.168 | 0/1 | 11.1s |
| #308 | Granite 4.2 8B none | IBM Granite | 1 | 3.0 | $0.037 | 0/1 | 14.6s |
| #312 | Hy3 preview none | Tencent | 1 | 3.0 | $0.007 | 0/1 | 2.71s |
| #313 | MiMo-V2-Flash none | Xiaomi | 1 | 3.0 | $0.025 | 0/1 | 1.82s |
| #314 | Ling 3.0 Tiny none | Inclusionai | 1 | 3.0 | $0.000 | 0/1 | 988ms |
| #315 | Granite 4.1 8B none | IBM Granite | 1 | 3.0 | $0.007 | 0/1 | 306ms |
| #316 | Nemotron 3.5 Lightning none | NVIDIA | 1 | 3.0 | $0.007 | 0/1 | 575ms |
| #317 | Grok Build 0.1 none | X AI | 1 | 3.0 | $0.547 | 0/1 | 36.1s |