指示追従 ランキング
指示追従 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 正解テスト ↑.
216/216
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 指示追従 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #205 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.003 | 1/2 | 13.0s |
| #206 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #210 | Qwen3.5-9B medium | Qwen | 6.5 | 3.8 | $0.036 | 1/2 | 5.75s |
| #211 | Laguna Xs.2 none | Poolside | 6.5 | 3.8 | $0.004 | 1/2 | 439ms |
| #213 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #216 | LFM2-24B-A2B none | Liquid | 6.3 | 2.2 | $0.001 | 1/2 | 752ms |
| #1 | Gemini 3.6 Flash medium | 9.9 | 9.9 | $0.831 | 2/2 | 2.77s | |
| #2 | Gemini 3.6 Flash high | 9.9 | 9.7 | $1.785 | 2/2 | 3.94s | |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 2/2 | 4.04s | |
| #4 | Gemini 3.5 Flash high | 10.0 | 9.5 | $1.976 | 2/2 | 3.35s | |
| #5 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.971 | 2/2 | 2.27s |
| #6 | Gemini 3.6 Flash low | 10.0 | 9.4 | $0.517 | 2/2 | 2.05s | |
| #7 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.4 | $1.316 | 2/2 | 2.50s |
| #8 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $1.234 | 2/2 | 2.73s |
| #9 | GPT-5.5 low | OpenAI | 9.9 | 9.3 | $1.253 | 2/2 | 3.74s |