AI BENCHY カテゴリ別失敗
反AIトリック: 回答なし
反AIトリック
回答なし
反AIトリック で 回答なし が起きやすいAIモデルを確認し、弱点を早く見つけられます。
| 順位 | モデル | 企業 | 回答なし 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #76 | Kimi K2.5 medium | Moonshot AI | 1 | 7.3 | 2/4 | 51.4s |
| #105 | Nemotron 3 Super medium | NVIDIA | 1 | 8.3 | 3/4 | 7.85s |
AI BENCHY カテゴリ別失敗
反AIトリック で 回答なし が起きやすいAIモデルを確認し、弱点を早く見つけられます。
| 順位 | モデル | 企業 | 回答なし 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #76 | Kimi K2.5 medium | Moonshot AI | 1 | 7.3 | 2/4 | 51.4s |
| #105 | Nemotron 3 Super medium | NVIDIA | 1 | 8.3 | 3/4 | 7.85s |