AI BENCHY カテゴリ別失敗
反AIトリック
回答なし
反AIトリック
回答なし
反AIトリック で 回答なし が起きやすいAIモデルを確認し、弱点を早く見つけられます。 並び替え: 応答時間(平均) ↓.
関連する失敗理由
| 順位 | モデル | 企業 | 回答なし 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #28 | Kimi K2.5 medium | Moonshot AI | 1 | 7.0 | 2/3 | 85.3s |