सामान्य ज्ञान: गलत उत्तर
सामान्य ज्ञान
गलत उत्तर
देखें कि सामान्य ज्ञान में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: कुल लागत ↑.
विफलता के कारण
259/259
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #185 | Dots 3 Note Preview low | Dots Studio | 1 | 3.0 | $0.000 | 0/1 | 8.80s |
| #186 | Dots 3 Note Preview high | Dots Studio | 1 | 3.0 | $0.000 | 0/1 | 17.3s |
| #218 | Dots 3 Note Preview medium | Dots Studio | 1 | 3.0 | $0.000 | 0/1 | 15.5s |
| #237 | Owl Alpha medium | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 2.38s |
| #240 | Owl Alpha none | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 2.50s |
| #263 | Dots 3 Note Preview none | Dots Studio | 1 | 3.0 | $0.000 | 0/1 | 961ms |
| #275 | North Mini Code none | Cohere | 1 | 3.0 | $0.000 | 0/1 | 37.4s |
| #297 | Cobuddy medium | Baidu | 1 | 3.0 | $0.000 | 0/1 | 37.0s |
| #314 | Ling 3.0 Tiny none | Inclusionai | 1 | 3.0 | $0.000 | 0/1 | 988ms |
| #283 | Ling-2.6-flash none | Inclusionai | 1 | 3.0 | $0.002 | 0/1 | 1.06s |
| #230 | Ling-3.0-flash none | Inclusionai | 1 | 3.0 | $0.004 | 0/1 | 10.6s |
| #246 | Qwen3.8 27B none | Qwen | 1 | 3.0 | ~$0.006 | 0/1 | 703ms |
| #315 | Granite 4.1 8B none | IBM Granite | 1 | 3.0 | $0.007 | 0/1 | 306ms |
| #316 | Nemotron 3.5 Lightning none | NVIDIA | 1 | 3.0 | $0.007 | 0/1 | 575ms |
| #312 | Hy3 preview none | Tencent | 1 | 3.0 | $0.007 | 0/1 | 2.71s |