उत्तर नाही अपयशे
कोणत्या AI मॉडेल्सना उत्तर नाही सर्वाधिक वेळा येतो ते पाहा, म्हणजे निवडण्यापूर्वी विश्वासार्हतेचे धोके लक्षात येतील. क्रम लावा: प्रतिसाद वेळ (सरासरी) ↑.
137/137
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | उत्तर नाही संख्या | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #254 | Kimi K2.6 none | Moonshot AI | 1 | 5.7 | $0.233 | 6/22 | 19.6s |
| #159 | GPT-6 Luna low | OpenAI | 1 | 7.0 | $0.020 | 11/22 | 22.0s |
| #24 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #111 | GLM 5 Turbo medium | Z.ai | 1 | 7.6 | $0.323 | 14/21 | 23.0s |
| #98 | GLM 5.2 medium | Z.ai | 2 | 7.8 | $0.151 | 15/21 | 23.3s |
| #92 | Step 3.7 Flash medium | Stepfun | 1 | 7.9 | $0.495 | 13/22 | 23.5s |
| #20 | Claude Opus 5.5 low | Anthropic | 1 | 9.3 | $0.952 | 18/22 | 23.7s |
| #319 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #30 | Claude Opus 5.5 medium | Anthropic | 1 | 9.0 | $1.080 | 19/22 | 24.2s |
| #140 | GLM 5.3 Flash high | Z.ai | 1 | 7.3 | $0.057 | 13/22 | 25.4s |
| #21 | Claude Opus 5.5 high | Anthropic | 1 | 9.3 | $1.266 | 18/22 | 25.9s |
| #79 | GPT-5 Mini medium | OpenAI | 1 | 8.1 | $0.241 | 12/22 | 27.6s |
| #64 | GPT-5.2 medium | OpenAI | 1 | 8.4 | $1.182 | 14/22 | 28.5s |
| #151 | Muse Glimmer 30B medium | Meta | 1 | 7.2 | $0.227 | 11/22 | 30.6s |
| #101 | Qwen3.8 27B medium | Qwen | 1 | 7.8 | ~$0.058 | 14/22 | 33.0s |