AI BENCHY
Your ad here

AI BENCHY カテゴリ別失敗

パズル解決: 不正解

パズル解決
不正解

パズル解決 で 不正解 が起きやすいAIモデルを確認し、弱点を早く見つけられます。

表示モデル数

5

総失敗数

85

最も影響を受けたモデル

Kimi K2.5 3
順位 モデル 企業 不正解 件数 カテゴリスコア 正解テスト 応答時間(平均)
#86 GPT-5.4 Mini none OpenAI 1 5.4 1/3 860ms
#88 Nemotron 3 Super none NVIDIA 1 5.7 1/3 7.50s
#90 Qwen3.5-9B none Qwen 1 3.2 0/3 683ms
#92 Qwen3 Coder Next medium Qwen 1 3.1 0/3 2.30s
#98 LFM2-24B-A2B none Liquid 1 4.4 0/3 1.69s

不正解 件数 上位モデル

不正解 件数 対 スコア

応答時間(平均) 上位モデル

推定無駄コスト 上位モデル