ツール呼び出し ランキング
ツール呼び出し でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 指標 ↑.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | ツール呼び出し スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #52 | GPT-5.2 medium | OpenAI | 4.7 | 8.4 | $1.182 | 0/1 | 10.3s |
| #96 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #102 | GPT-5.4 Mini medium | OpenAI | 4.7 | 7.5 | $0.786 | 0/1 | 9.62s |
| #143 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #147 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #264 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.208 | 0/1 | 12.0s |
| #272 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.8 | $0.008 | 0/1 | 16.0s |
| #290 | Laguna S 2.1 none | Poolside | 4.7 | 4.5 | $0.022 | 0/1 | 1.45s |
| #299 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #159 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #234 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.062 | 1/1 | 6.74s |
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.011 | 1/1 | 4.61s |
| #263 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #31 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |
| #34 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |