指示追従 ランキング
指示追従 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 指標 ↑.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 指示追従 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #301 | MiMo-V2-Flash none | Xiaomi | 6.5 | 4.0 | $0.025 | 1/2 | 857ms |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 6.5 | 4.0 | $0.007 | 1/2 | 511ms |
| #309 | Qwen3.5-9B medium | Qwen | 6.5 | 3.8 | $0.062 | 1/2 | 5.75s |
| #311 | Laguna Xs.2 none | Poolside | 6.5 | 3.8 | $0.004 | 1/2 | 439ms |
| #307 | Ling 3.0 Tiny low | Inclusionai | 6.6 | 3.8 | $0.000 | 1/2 | 3.09s |
| #310 | Ling 3.0 Tiny medium | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.00s |
| #306 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |
| #273 | Hy4 preview none | Tencent | 7.0 | 4.8 | $0.041 | 1/2 | 47.9s |
| #241 | GPT-5.6 Luna none | OpenAI | 7.1 | 5.4 | $0.029 | 1/2 | 1.23s |
| #217 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.050 | 1/2 | 6.97s |
| #313 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #56 | Muse Spark 1.1 low | Meta | 7.3 | 8.3 | $0.673 | 1/2 | 5.42s |
| #57 | Claude Fable 5.1 medium | Anthropic | 7.3 | 8.3 | $2.909 | 1/2 | 5.77s |
| #224 | Gemini 3.1 Flash Lite high | 7.3 | 5.6 | $2.044 | 1/2 | 23.3s | |
| #257 | Mistral Small 4 medium | Mistral | 7.3 | 5.1 | $0.097 | 1/2 | 1.38s |