Samanya Buddhimatta: गलत उत्तर
Samanya Buddhimatta
गलत उत्तर
देखें कि Samanya Buddhimatta में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
90/90
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #267 | Nemotron 3 Super none | NVIDIA | 1 | 4.6 | $0.008 | 0/1 | 950ms |
| #268 | Hy4 preview none | Tencent | 1 | 5.1 | $0.041 | 0/1 | 58.3s |
| #269 | Ring-2.6-1T none | Inclusionai | 1 | 4.3 | $0.026 | 0/1 | 15.6s |
| #270 | Nemotron 3.5 Lightning low | NVIDIA | 1 | 3.7 | $0.140 | 0/1 | 4.61s |
| #274 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 5.0 | $0.070 | 0/1 | 12.0s |
| #275 | GLM 4.7 Flash none | Z.ai | 1 | 4.0 | $0.016 | 0/1 | 1.59s |
| #282 | Granite 4.2 8B high | IBM Granite | 1 | 5.5 | $0.084 | 0/1 | 16.4s |
| #285 | Laguna S 2.1 none | Poolside | 1 | 5.0 | $0.022 | 0/1 | 815ms |
| #289 | GLM 4.7 Flash medium | Z.ai | 1 | 3.6 | $0.168 | 0/1 | 18.1s |
| #291 | Granite 4.2 8B none | IBM Granite | 1 | 5.0 | $0.026 | 0/1 | 770ms |
| #293 | Grok 4.20 none | X AI | 1 | 4.8 | $0.057 | 0/1 | 659ms |
| #298 | Granite 4.1 8B none | IBM Granite | 1 | 4.0 | $0.007 | 0/1 | 499ms |
| #299 | Nemotron 3.5 Lightning none | NVIDIA | 1 | 4.4 | $0.007 | 0/1 | 586ms |
| #300 | Grok Build 0.1 none | X AI | 1 | 4.3 | $0.547 | 0/1 | 12.5s |
| #307 | gpt-oss-120b none | OpenAI | 1 | 4.8 | $0.010 | 0/1 | 10.8s |