コーディング: 不正解
コーディング
不正解
コーディング で 不正解 が起きやすいAIモデルを確認し、弱点を早く見つけられます。
199/199
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 不正解 件数 | カテゴリスコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #223 | KAT-Coder-Air V2.5 low | Kwaipilot | 1 | 3.5 | $0.046 | 0/3 | 11.1s |
| #232 | Ling-2.6-1T none | Inclusionai | 1 | 3.8 | $0.016 | 0/3 | 10.6s |
| #255 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #257 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 3.3 | $0.070 | 0/3 | 14.3s |
| #259 | Trinity Large Preview none | Arcee AI | 1 | 3.7 | $0.008 | 0/3 | 14.3s |
| #263 | Cobuddy medium | Baidu | 1 | 3.7 | $0.000 | 0/3 | 79.2s |
| #266 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.327 | 0/3 | 188.6s |
| #268 | Grok 4.20 Beta none | X AI | 1 | 1.8 | $0.087 | 0/1 | 1.14s |
| #269 | Laguna M.1 none | Poolside | 1 | 2.5 | $0.009 | 0/1 | 2.93s |
| #270 | Elephant Alpha none | Openrouter | 1 | 4.2 | $0.000 | 0/3 | 1.39s |
| #272 | Elephant Alpha medium | Openrouter | 1 | 3.7 | $0.000 | 0/3 | 1.30s |
| #274 | Grok 4.20 none | X AI | 1 | 1.1 | $0.057 | 0/1 | 1.22s |
| #275 | Laguna Xs.2 medium | Poolside | 1 | 2.1 | $0.015 | 0/1 | 14.4s |
| #276 | Hy3 preview none | Tencent | 1 | 2.7 | $0.007 | 0/3 | 4.56s |
| #279 | Granite 4.1 8B none | IBM Granite | 1 | 4.5 | $0.007 | 0/3 | 775ms |