Samanya Buddhimatta: गलत उत्तर
Samanya Buddhimatta
गलत उत्तर
देखें कि Samanya Buddhimatta में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
विफलता के कारण
59/59
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #201 | Granite 4.1 8B none | IBM Granite | 1 | 4.0 | $0.007 | 0/1 | 499ms |
| #160 | Laguna XS 2.1 none | Poolside | 1 | 5.0 | $0.008 | 0/1 | 529ms |
| #118 | Gemini 2.5 Flash none | 1 | 5.0 | $0.017 | 0/1 | 615ms | |
| #197 | Grok 4.20 none | X AI | 1 | 4.8 | $0.057 | 0/1 | 659ms |
| #165 | Mistral Small 4 none | Mistral | 1 | 4.0 | $0.022 | 0/1 | 729ms |
| #151 | GLM 5.1 none | Z.ai | 1 | 5.0 | $0.164 | 0/1 | 790ms |
| #164 | Inkling none | Thinkingmachines | 1 | 5.0 | $0.147 | 0/1 | 859ms |
| #174 | GPT-4o-mini none | OpenAI | 1 | 4.0 | $0.010 | 0/1 | 909ms |
| #177 | Nemotron 3 Super none | NVIDIA | 1 | 4.6 | $0.008 | 0/1 | 950ms |
| #122 | Gemini 3.1 Flash Lite none | 1 | 4.0 | $0.046 | 0/1 | 992ms | |
| #159 | GPT-5.6 Luna none | OpenAI | 1 | 5.0 | $0.142 | 0/1 | 1.00s |
| #132 | GPT-5.6 Terra none | OpenAI | 1 | 5.0 | $0.349 | 0/1 | 1.03s |
| #105 | Gemini 3.1 Flash Lite low | 1 | 4.0 | $0.621 | 0/1 | 1.37s | |
| #178 | Ling-2.6-flash none | Inclusionai | 1 | 4.0 | $0.002 | 0/1 | 1.45s |
| #83 | GPT-5.6 Sol none | OpenAI | 1 | 6.5 | $0.524 | 0/1 | 1.52s |