ツール呼び出し ランキング
ツール呼び出し でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 応答時間(平均) ↑.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | ツール呼び出し スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #230 | Owl Alpha none | Openrouter | 10.0 | 5.6 | $0.000 | 1/1 | 22.8s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 1/1 | 23.1s | |
| #249 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/1 | 25.7s |
| #61 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 1/1 | 25.9s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 1/1 | 26.0s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 1/1 | 27.4s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 10.0 | 8.4 | $1.951 | 1/1 | 27.5s |
| #283 | Grok 4.1 Fast medium | X AI | 2.8 | 4.7 | $0.069 | 0/1 | 27.7s |
| #182 | MiMo-V2-Flash medium | Xiaomi | 10.0 | 6.3 | $0.043 | 1/1 | 27.8s |
| #122 | KAT-Coder-Pro V2.5 high | Kwaipilot | 10.0 | 7.2 | $0.506 | 1/1 | 28.0s |
| #34 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #139 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.479 | 1/1 | 31.7s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 1/1 | 32.9s |
| #204 | GPT-5 Nano medium | OpenAI | 10.0 | 6.0 | $0.118 | 1/1 | 33.3s |
| #300 | Hy3 preview none | Tencent | 10.0 | 4.0 | $0.007 | 1/1 | 33.8s |