Samanya Buddhimatta: गलत उत्तर
Samanya Buddhimatta
गलत उत्तर
देखें कि Samanya Buddhimatta में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↑.
विफलता के कारण
62/62
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #23 | Grok 4.5 low | X AI | 1 | 6.1 | $0.935 | 0/1 | 4.88s |
| #25 | Grok 4.5 medium | X AI | 1 | 6.5 | $1.928 | 0/1 | 12.8s |
| #31 | Gemini 3.5 Flash-Lite high | 1 | 5.4 | $0.584 | 0/1 | 3.40s | |
| #33 | Step 3.7 Flash medium | Stepfun | 1 | 4.0 | $0.515 | 0/1 | 6.85s |
| #38 | GPT-5.6 Terra high | OpenAI | 1 | 5.1 | $1.055 | 0/1 | 3.03s |
| #43 | GPT-5.6 Terra medium | OpenAI | 1 | 5.5 | $0.676 | 0/1 | 2.37s |
| #48 | GPT-5.6 Luna high | OpenAI | 1 | 5.0 | $1.017 | 0/1 | 3.65s |
| #52 | Grok Build 0.1 medium | X AI | 1 | 4.4 | $1.097 | 0/1 | 18.4s |
| #53 | GLM 5 Turbo medium | Z.ai | 1 | 6.1 | $0.323 | 0/1 | 10.1s |
| #54 | GPT-5.6 Luna medium | OpenAI | 1 | 5.1 | $0.352 | 0/1 | 4.34s |
| #59 | GPT-5.6 Terra low | OpenAI | 1 | 4.8 | $0.519 | 0/1 | 3.52s |
| #64 | LongCat 2.0 medium | Meituan | 1 | 4.8 | $0.478 | 0/1 | 16.4s |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 4.1 | $0.387 | 0/1 | 2.32s |
| #71 | Step 3.7 Flash low | Stepfun | 1 | 3.4 | $0.454 | 0/1 | 7.00s |
| #73 | KAT-Coder-Pro V2.5 high | Kwaipilot | 1 | 5.1 | $0.482 | 0/1 | 3.27s |