संयुक्त: गलत उत्तर
संयुक्त
गलत उत्तर
देखें कि संयुक्त में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
63/63
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #164 | Inkling none | Thinkingmachines | 1 | 2.9 | $0.147 | 0/2 | 25.7s |
| #166 | Qwen3 Coder Next none | Qwen | 1 | 3.0 | $0.025 | 0/2 | 30.9s |
| #167 | Mistral Small 4 medium | Mistral | 1 | 3.0 | $0.096 | 0/2 | 32.4s |
| #168 | MiMo-V2.5 none | Xiaomi | 1 | 3.0 | $0.025 | 0/2 | 28.9s |
| #170 | GLM 5 Turbo none | Z.ai | 1 | 1.5 | $0.047 | 0/1 | 4.89s |
| #174 | GPT-4o-mini none | OpenAI | 1 | 3.0 | $0.010 | 0/2 | 6.32s |
| #180 | GPT-5.4 Nano none | OpenAI | 1 | 3.0 | $0.041 | 0/2 | 14.7s |
| #182 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 3.8 | $0.067 | 0/2 | 73.0s |
| #183 | Trinity Large Preview none | Arcee AI | 1 | 1.5 | $0.008 | 0/1 | 8.91s |
| #187 | Qwen3 Coder Next medium | Qwen | 1 | 3.0 | $0.032 | 0/2 | 14.6s |
| #193 | Elephant Alpha none | Openrouter | 1 | 1.5 | $0.000 | 0/1 | 3.81s |
| #195 | Elephant Alpha medium | Openrouter | 1 | 1.5 | $0.000 | 0/1 | 3.70s |
| #196 | Hunter Alpha none | OpenRouter | 1 | 1.5 | $0.000 | 0/1 | 15.2s |
| #198 | Laguna Xs.2 medium | Poolside | 1 | 1.5 | $0.015 | 0/1 | 15.9s |
| #199 | Hy3 preview none | Tencent | 1 | 1.5 | $0.003 | 0/1 | 35.8s |