संयुक्त: गलत उत्तर
संयुक्त
गलत उत्तर
देखें कि संयुक्त में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
90/90
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #190 | Qwen3.7 Flash none | Qwen | 1 | 3.8 | $0.019 | 0/2 | 94.6s |
| #191 | Gemini 3.1 Flash Lite none | 1 | 3.0 | $0.046 | 0/2 | 9.49s | |
| #196 | Gemma 4 31B none | 1 | 3.8 | $0.016 | 0/2 | 30.0s | |
| #197 | Qwen3.5 Plus 2026-04-20 none | Qwen | 1 | 6.4 | $0.122 | 1/2 | 109.7s |
| #198 | Nemotron 3 Ultra none | NVIDIA | 1 | 3.0 | $0.093 | 0/2 | 21.1s |
| #200 | Gemini 2.5 Flash none | 1 | 3.0 | $0.017 | 0/2 | 61.2s | |
| #203 | Gemini 3 PRO Preview medium | 1 | 1.5 | $0.385 | 0/1 | 10.4s | |
| #205 | Qwen3.5-Flash none | Qwen | 1 | 2.9 | $0.073 | 0/2 | 243.6s |
| #206 | Qwen3.5-35B-A3B none | Qwen | 1 | 3.8 | $0.076 | 0/2 | 128.3s |
| #211 | GLM 5.3 Flash low | Z.ai | 1 | 3.8 | $0.015 | 0/2 | 54.7s |
| #212 | GPT-5.4 Mini none | OpenAI | 1 | 6.5 | $0.095 | 1/2 | 6.22s |
| #213 | Seed 2.1 Turbo none | Bytedance Seed | 1 | 3.8 | $0.092 | 0/2 | 41.3s |
| #215 | Solar Pro 4 none | Upstage | 1 | 3.0 | $0.006 | 0/2 | 35.1s |
| #218 | GLM 5 none | Z.ai | 1 | 1.5 | $0.027 | 0/1 | 4.98s |
| #219 | Inkling Small low | Thinkingmachines | 1 | 3.0 | $0.055 | 0/2 | 4.08s |