AI BENCHY カテゴリ別失敗
ドメイン特化
余分な書式
ドメイン特化
余分な書式
ドメイン特化 で 余分な書式 が起きやすいAIモデルを確認し、弱点を早く見つけられます。 並び替え: 正解テスト ↑.
| 順位 | モデル | 企業 | 余分な書式 件数 | カテゴリスコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #11 | Claude Sonnet 4.6 medium | Anthropic | 1 | 10.0 | 0/3 | 0ms |
| #26 | Claude Opus 4.6 medium | Anthropic | 2 | 10.0 | 0/3 | 83.4s |