उत्तर नाही अपयशे
कोणत्या AI मॉडेल्सना उत्तर नाही सर्वाधिक वेळा येतो ते पाहा, म्हणजे निवडण्यापूर्वी विश्वासार्हतेचे धोके लक्षात येतील. क्रम लावा: प्रतिसाद वेळ (सरासरी) ↓.
73/73
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | उत्तर नाही संख्या | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #180 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.163 | 5/22 | 41.3s |
| #140 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #46 | GLM 5 medium | Z.ai | 1 | 7.7 | $0.307 | 15/21 | 33.5s |
| #107 | MiMo-V2.5 medium | Xiaomi | 1 | 6.5 | $0.082 | 12/22 | 32.2s |
| #30 | Muse Spark 1.1 high | Meta | 1 | 8.1 | $1.694 | 12/22 | 31.5s |
| #29 | GPT-5 Mini medium | OpenAI | 1 | 8.1 | $0.237 | 12/22 | 27.6s |
| #33 | Step 3.7 Flash medium | Stepfun | 1 | 8.0 | $0.515 | 14/22 | 26.4s |
| #194 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #42 | GLM 5.2 medium | Z.ai | 2 | 7.8 | $0.182 | 15/21 | 23.3s |
| #53 | GLM 5 Turbo medium | Z.ai | 1 | 7.6 | $0.323 | 14/21 | 23.0s |
| #24 | GPT-5.2 medium | OpenAI | 1 | 8.4 | $0.951 | 14/22 | 22.6s |
| #71 | Step 3.7 Flash low | Stepfun | 1 | 7.3 | $0.454 | 12/22 | 20.7s |
| #144 | Kimi K2.6 none | Moonshot AI | 1 | 5.8 | $0.184 | 7/22 | 19.6s |
| #161 | Kimi K2.5 none | Moonshot AI | 1 | 5.5 | $0.127 | 6/22 | 19.2s |
| #20 | Claude Fable 5 medium | Anthropic | 2 | 8.6 | $3.478 | 17/22 | 17.2s |