उत्तर नाही अपयशे
कोणत्या AI मॉडेल्सना उत्तर नाही सर्वाधिक वेळा येतो ते पाहा, म्हणजे निवडण्यापूर्वी विश्वासार्हतेचे धोके लक्षात येतील. क्रम लावा: स्कोअर ↓.
137/137
मॉडेल फिल्टर करा
सध्याच्या शोध आणि फिल्टर्सशी जुळणारी कोणतीही मॉडेल्स नाहीत.
| क्रमांक | मॉडेल | कंपनी | उत्तर नाही संख्या | स्कोअर | एकूण खर्च | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|
| #301 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #304 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #312 | GPT-5.4 Nano none | OpenAI | 1 | 4.8 | $0.041 | 4/22 | 2.56s |
| #313 | Trinity Large Thinking high | Arcee AI | 1 | 4.8 | $0.592 | 5/22 | 75.9s |
| #319 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #320 | Laguna M.1 medium | Poolside | 1 | 4.7 | $0.033 | 9/19 | 14.7s |
| #323 | Granite 4.2 8B high | IBM Granite | 1 | 4.6 | $0.135 | 4/22 | 235.9s |
| #324 | Qwen3 Coder Next medium | Qwen | 1 | 4.6 | $0.034 | 3/22 | 9.07s |
| #325 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |
| #326 | Laguna S 2.1 none | Poolside | 1 | 4.5 | $0.022 | 2/22 | 11.7s |
| #330 | GLM 4.7 Flash medium | Z.ai | 3 | 4.3 | $0.168 | 4/22 | 134.3s |
| #335 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #343 | Ling 3.0 Tiny high | Inclusionai | 7 | 3.8 | $0.000 | 4/22 | 75.7s |
| #344 | Ling 3.0 Tiny low | Inclusionai | 7 | 3.8 | $0.000 | 4/22 | 66.2s |
| #346 | Qwen3.5-9B medium | Qwen | 3 | 3.8 | $0.062 | 3/22 | 107.5s |