複合 ランキング
複合 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 正解テスト ↑.
311/311
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 複合 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #86 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 2/2 | 19.0s |
| #87 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.050 | 2/2 | 202.5s |
| #90 | GPT-5.4 Nano medium | OpenAI | 9.9 | 7.5 | $0.142 | 2/2 | 32.2s |
| #92 | MiniMax M3 medium | Minimax | 10.0 | 7.5 | $0.300 | 2/2 | 138.2s |
| #93 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 2/2 | 15.1s |
| #98 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 2/2 | 65.1s |
| #103 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 2/2 | 14.6s |
| #108 | Claude Sonnet 4.6 none | Anthropic | 9.8 | 7.3 | $0.661 | 2/2 | 37.5s |
| #113 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 2/2 | 117.7s |
| #115 | Claude Opus 4.8 none | Anthropic | 9.8 | 7.3 | $1.166 | 2/2 | 26.4s |
| #129 | GLM 5.1 medium | Z.ai | 9.8 | 7.0 | $0.727 | 2/2 | 175.9s |
| #136 | Claude Fable 5.1 low | Anthropic | 10.0 | 6.9 | $2.565 | 2/2 | 29.4s |
| #152 | LongCat 2.0 low | Meituan | 10.0 | 6.7 | $0.412 | 2/2 | 130.2s |
| #155 | LongCat 2.0 high | Meituan | 10.0 | 6.7 | $0.492 | 2/2 | 167.1s |
| #156 | Claude Opus 4.7 none | Anthropic | 4.8 | 6.6 | $0.505 | 1/1 | 18.3s |