無効なツール呼び出し の失敗
どのAIモデルで 無効なツール呼び出し が起きやすいかを確認し、選ぶ前に信頼性のリスクを見極められます。 並び替え: 応答時間(平均) ↓.
カテゴリ
83/83
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 無効なツール呼び出し 件数 | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #160 | Laguna XS 2.1 none | Poolside | 1 | 5.3 | $0.008 | 5/22 | 1.55s |
| #159 | GPT-5.6 Luna none | OpenAI | 1 | 5.4 | $0.142 | 6/22 | 1.50s |
| #201 | Granite 4.1 8B none | IBM Granite | 2 | 4.0 | $0.007 | 2/22 | 1.45s |
| #195 | Elephant Alpha medium | Openrouter | 1 | 4.3 | $0.000 | 6/21 | 1.27s |
| #193 | Elephant Alpha none | Openrouter | 1 | 4.3 | $0.000 | 5/21 | 1.22s |
| #191 | Grok 4.20 Beta none | X AI | 1 | 4.4 | $0.087 | 6/18 | 1.19s |
| #197 | Grok 4.20 none | X AI | 1 | 4.1 | $0.057 | 6/18 | 1.11s |
| #205 | Laguna Xs.2 none | Poolside | 1 | 3.8 | $0.004 | 5/19 | 806ms |