संयुक्त: गलत उत्तर
संयुक्त
गलत उत्तर
देखें कि संयुक्त में किन AI मॉडलों में गलत उत्तर आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें।
विफलता के कारण
90/90
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | गलत उत्तर संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #290 | Laguna S 2.1 none | Poolside | 1 | 2.9 | $0.022 | 0/2 | 21.6s |
| #293 | Elephant Alpha none | Openrouter | 1 | 1.5 | $0.000 | 0/1 | 3.81s |
| #295 | Elephant Alpha medium | Openrouter | 1 | 1.5 | $0.000 | 0/1 | 3.70s |
| #296 | Granite 4.2 8B none | IBM Granite | 1 | 3.0 | $0.026 | 0/2 | 424.3s |
| #297 | Hunter Alpha none | OpenRouter | 1 | 1.5 | $0.000 | 0/1 | 15.2s |
| #299 | Laguna Xs.2 medium | Poolside | 1 | 1.5 | $0.015 | 0/1 | 15.9s |
| #300 | Hy3 preview none | Tencent | 1 | 1.5 | $0.007 | 0/1 | 35.8s |
| #301 | MiMo-V2-Flash none | Xiaomi | 1 | 1.5 | $0.025 | 0/1 | 2.87s |
| #302 | Ling 3.0 Tiny none | Inclusionai | 1 | 3.0 | $0.000 | 0/2 | 124.2s |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 1 | 3.0 | $0.007 | 0/2 | 2.02s |
| #306 | Ling 3.0 Tiny high | Inclusionai | 1 | 3.0 | $0.000 | 0/2 | 179.9s |
| #307 | Ling 3.0 Tiny low | Inclusionai | 1 | 3.0 | $0.000 | 0/2 | 134.8s |
| #308 | Grok 4.1 Fast none | X AI | 1 | 1.5 | $0.008 | 0/1 | 3.33s |
| #310 | Ling 3.0 Tiny medium | Inclusionai | 1 | 3.0 | $0.000 | 0/2 | 139.8s |
| #311 | Laguna Xs.2 none | Poolside | 1 | 1.5 | $0.004 | 0/1 | 2.01s |