AI BENCHY
Advertise here

AI BENCHY カテゴリ

汎用知能 ランキング

汎用知能 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 正解テスト ↑.

表示モデル数

15

平均 汎用知能 スコア

5.9

最良モデル

GPT-5.3-Codex 4.6
順位 モデル 企業 汎用知能 スコア スコア 正解テスト 応答時間(平均)
#79 Hunter Alpha medium OpenRouter 7.0 6.7 0/1 6.44s
#80 Mimo V2 Omni medium Xiaomi 5.4 6.7 0/1 3.61s
#81 Mercury 2 medium Inception 4.8 6.6 0/1 821ms
#82 Hy3 preview high Tencent 3.0 6.6 0/1 0ms
#83 Step 3.5 Flash none Stepfun 4.0 6.6 0/1 14.4s
#84 Grok 4.20 Multi Agent Beta medium X AI 5.8 6.6 0/1 6.40s
#86 Grok 4.1 Fast medium X AI 4.2 6.5 0/1 16.2s
#87 Gemini 3.1 Flash Lite minimal Google 4.0 6.4 0/1 791ms
#88 Qwen3.7 Plus none Qwen 5.3 6.4 0/1 1.33s
#89 Hy3 preview low Tencent 3.0 6.4 0/1 0ms
#90 Gemini 3.1 Flash Lite none Google 4.0 6.4 0/1 992ms
#92 Laguna M.1 medium Poolside 3.0 6.4 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 3.0 6.3 0/1 0ms
#94 GPT-5 Nano medium OpenAI 4.1 6.3 0/1 17.5s
#95 Qwen3.5 Plus 2026-02-15 none Qwen 4.4 6.3 0/1 2.26s

汎用知能 スコア 上位モデル

汎用知能 スコア vs 合計コスト

応答時間(平均) 上位モデル