सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
197/197
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #182 | Hy3 preview low | Tencent | 1 | 3.0 | $0.015 | 0/1 | 41.7s |
| #183 | MiMo-V2.5-Pro none | Xiaomi | 1 | 3.0 | $0.068 | 0/1 | 1.89s |
| #184 | Kimi K2.5 none | Moonshot AI | 1 | 3.0 | $0.127 | 0/1 | 3.90s |
| #185 | Gemma 4 26B A4B none | 1 | 3.0 | $0.015 | 0/1 | 778ms | |
| #186 | Mimo V2 Omni none | Xiaomi | 1 | 3.0 | $0.021 | 0/1 | 1.30s |
| #187 | Laguna S 2.1 medium | Poolside | 1 | 3.0 | $0.053 | 0/1 | 7.11s |
| #188 | KAT-Coder-Air V2.5 low | Kwaipilot | 1 | 3.0 | $0.041 | 0/1 | 20.0s |
| #189 | GPT-5.6 Luna none | OpenAI | 1 | 3.0 | $0.015 | 0/1 | 651ms |
| #190 | DeepSeek V4 Flash 0731 none | DeepSeek | 1 | 3.0 | $0.014 | 0/1 | 1.85s |
| #191 | Laguna S 2.1 high | Poolside | 1 | 3.0 | $0.114 | 0/1 | 6.94s |
| #192 | Inkling Small none | Thinkingmachines | 1 | 3.0 | $0.058 | 0/1 | 481ms |
| #193 | Laguna XS 2.1 none | Poolside | 1 | 3.0 | $0.008 | 0/1 | 254ms |
| #194 | Qwen3.6 35B A3B none | Qwen | 1 | 3.0 | $0.061 | 0/1 | 414ms |
| #197 | Inkling none | Thinkingmachines | 1 | 3.0 | $0.147 | 0/1 | 670ms |
| #198 | Mistral Small 4 none | Mistral | 1 | 3.0 | $0.022 | 0/1 | 397ms |