ツール呼び出し ランキング
ツール呼び出し でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | ツール呼び出し スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #34 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #65 | Muse Spark 1.1 high | Meta | 9.6 | 8.0 | $2.253 | 1/1 | 9.88s |
| #202 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.280 | 1/1 | 3.10s |
| #234 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.062 | 1/1 | 6.74s |
| #244 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.011 | 1/1 | 4.61s |
| #263 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #159 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #52 | GPT-5.2 medium | OpenAI | 4.7 | 8.4 | $1.182 | 0/1 | 10.3s |
| #96 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #102 | GPT-5.4 Mini medium | OpenAI | 4.7 | 7.5 | $0.786 | 0/1 | 9.62s |
| #143 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #147 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #264 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.208 | 0/1 | 12.0s |
| #272 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.8 | $0.008 | 0/1 | 16.0s |
| #290 | Laguna S 2.1 none | Poolside | 4.7 | 4.5 | $0.022 | 0/1 | 1.45s |