汎用知能 ランキング
汎用知能 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 合計コスト ↓.
216/216
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 汎用知能 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #55 | Nemotron 3 Ultra medium | NVIDIA | 3.7 | 7.5 | $0.774 | 0/1 | 2.52s |
| #60 | GPT-5.4 Mini medium | OpenAI | 4.5 | 7.5 | $0.756 | 0/1 | 3.72s |
| #137 | Grok 4.20 Beta medium | X AI | 10.0 | 6.0 | $0.750 | 1/1 | 5.78s |
| #94 | Qwen3.6 35B A3B medium | Qwen | 4.4 | 6.7 | $0.746 | 0/1 | 8.66s |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 1/1 | 5.19s | |
| #56 | Kimi K2.7 Code medium | Moonshot AI | 10.0 | 7.5 | $0.740 | 1/1 | 10.8s |
| #89 | Qwen3.6 Flash medium | Qwen | 4.8 | 6.9 | $0.738 | 0/1 | 9.88s |
| #140 | Mimo V2 Omni medium | Xiaomi | 5.4 | 5.9 | $0.683 | 0/1 | 3.61s |
| #43 | GPT-5.6 Terra medium | OpenAI | 5.5 | 7.8 | $0.676 | 0/1 | 2.37s |
| #67 | Claude Sonnet 4.6 none | Anthropic | 6.1 | 7.3 | $0.661 | 0/1 | 2.56s |
| #27 | Muse Spark 1.1 low | Meta | 10.0 | 8.3 | $0.647 | 1/1 | 4.12s |
| #110 | Gemini 3.1 Flash Lite Preview low | 4.0 | 6.5 | $0.646 | 0/1 | 1.54s | |
| #28 | Gemini 2.5 Flash medium | 4.8 | 8.2 | $0.643 | 0/1 | 4.86s | |
| #12 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.642 | 1/1 | 2.52s | |
| #111 | Gemini 3.1 Flash Lite low | 4.0 | 6.5 | $0.621 | 0/1 | 1.37s |