パズル解決 ランキング
パズル解決 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 応答時間(平均) ↑.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | パズル解決 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #103 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #216 | North Mini Code medium | Cohere | 3.3 | 5.7 | $0.000 | 0/3 | 19.7s |
| #178 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |
| #204 | GPT-5 Nano medium | OpenAI | 5.3 | 6.0 | $0.118 | 1/3 | 20.6s |
| #180 | Ring-2.6-1T medium | Inclusionai | 5.9 | 6.4 | $0.102 | 1/3 | 20.7s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 9.9 | 8.4 | $1.951 | 3/3 | 21.0s |
| #189 | gpt-oss-120b medium | OpenAI | 5.3 | 6.1 | $0.020 | 1/3 | 21.7s |
| #131 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 23.5s |
| #238 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.039 | 0/3 | 23.7s |
| #273 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #45 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 3/3 | 24.3s |
| #259 | Qwen3 Coder Next none | Qwen | 3.0 | 5.1 | $0.026 | 0/3 | 24.3s |
| #263 | North Mini Code none | Cohere | 3.5 | 5.1 | $0.000 | 0/3 | 24.4s |
| #264 | MiniMax M2.7 medium | Minimax | 5.9 | 5.0 | $0.208 | 1/3 | 24.9s |