उत्तर नाही अपयशे
कोणत्या AI मॉडेल्सना उत्तर नाही सर्वाधिक वेळा येतो ते पाहा, म्हणजे निवडण्यापूर्वी विश्वासार्हतेचे धोके लक्षात येतील. क्रम लावा: बरोबर चाचण्या ↓.
137/137
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | उत्तर नाही संख्या | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #180 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.8 | $0.221 | 11/22 | 48.7s |
| #206 | GLM 5.3 FlashX medium | Z.ai | 1 | 6.4 | $0.056 | 11/22 | 4.32s |
| #208 | MiMo-V2.5 medium | Xiaomi | 2 | 6.4 | $0.104 | 11/22 | 46.3s |
| #213 | GLM 5.3 FlashX low | Z.ai | 1 | 6.3 | $0.090 | 11/22 | 6.58s |
| #220 | Qwen3.5-35B-A3B medium | Qwen | 3 | 6.1 | $1.148 | 11/22 | 110.8s |
| #239 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #241 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #319 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #320 | Laguna M.1 medium | Poolside | 1 | 4.7 | $0.033 | 9/19 | 14.7s |
| #108 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.454 | 10/22 | 92.5s |
| #147 | Muse Glimmer 30B high | Meta | 2 | 7.2 | $0.430 | 10/22 | 66.7s |
| #166 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.479 | 10/22 | 98.2s |
| #186 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.412 | 10/22 | 113.6s |
| #199 | Qwen3.6 27B medium | Qwen | 3 | 6.5 | $0.770 | 10/22 | 106.1s |
| #204 | Dots 3 Note Preview low | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 61.8s |