AI BENCHY カテゴリ別失敗
ドメイン特化: 指示に従っていない
ドメイン特化
指示に従っていない
ドメイン特化 で 指示に従っていない が起きやすいAIモデルを確認し、弱点を早く見つけられます。 並び替え: 正解テスト ↑.
| 順位 | モデル | 企業 | 指示に従っていない 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #82 | Grok Build 0.1 none | X AI | 1 | 3.6 | 0/3 | 103.7s |
AI BENCHY カテゴリ別失敗
ドメイン特化 で 指示に従っていない が起きやすいAIモデルを確認し、弱点を早く見つけられます。 並び替え: 正解テスト ↑.
| 順位 | モデル | 企業 | 指示に従っていない 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #82 | Grok Build 0.1 none | X AI | 1 | 3.6 | 0/3 | 103.7s |