AI BENCHY
Advertise here

AI BENCHY カテゴリ

汎用知能 ランキング

汎用知能 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 正解テスト ↑.

表示モデル数

15

平均 汎用知能 スコア

5.9

最良モデル

GPT-5.3-Codex 4.6
順位 モデル 企業 汎用知能 スコア スコア 正解テスト 応答時間(平均)
#62 Step 3.5 Flash medium Stepfun 5.5 7.2 0/1 22.4s
#63 GPT-5.3 Chat none OpenAI 4.6 7.2 0/1 1.99s
#64 MiMo-V2-Flash medium Xiaomi 4.0 7.2 0/1 4.20s
#65 Grok 4.20 medium X AI 3.9 7.1 0/1 24.5s
#66 Qwen3.5-35B-A3B medium Qwen 2.8 7.1 0/1 30.3s
#67 MiniMax M3 medium Minimax 5.1 7.1 0/1 33.3s
#70 GPT-5.4 Nano medium OpenAI 4.5 7.0 0/1 4.15s
#71 Step 3.7 Flash high Stepfun 5.5 7.0 0/1 4.17s
#72 DeepSeek V3.2 medium DeepSeek 3.4 7.0 0/1 58.3s
#73 Seed-2.0-Mini medium Bytedance Seed 5.1 6.9 0/1 36.7s
#74 Qwen3.6 Max Preview none Qwen 4.3 6.9 0/1 1.62s
#75 Ring-2.6-1T medium Inclusionai 4.1 6.9 0/1 58.3s
#76 Kimi K2.5 medium Moonshot AI 6.5 6.8 0/1 69.7s
#77 Claude Sonnet 4.6 none Anthropic 6.1 6.8 0/1 2.56s
#78 Qwen3.6 27B medium Qwen 6.5 6.8 0/1 39.5s

汎用知能 スコア 上位モデル

汎用知能 スコア vs 合計コスト

応答時間(平均) 上位モデル