指示追従 ランキング
指示追従 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 応答時間(平均) ↑.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 指示追従 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.595 | 2/2 | 4.73s | |
| #207 | Step 3.5 Flash medium | Stepfun | 8.3 | 5.9 | $0.132 | 1/2 | 4.78s |
| #20 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 2/2 | 4.78s |
| #22 | Gemini 3.8 Flash medium | 10.0 | 9.1 | $0.653 | 2/2 | 4.81s | |
| #201 | Grok 4.20 Beta medium | X AI | 9.8 | 6.0 | $0.750 | 2/2 | 4.89s |
| #5 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $5.156 | 2/2 | 4.91s |
| #232 | Nemotron 3.5 Lightning high | NVIDIA | 8.5 | 5.6 | $0.134 | 1/2 | 4.98s |
| #209 | Mimo V2 Omni medium | Xiaomi | 8.3 | 5.9 | $0.683 | 1/2 | 4.99s |
| #59 | Muse Spark 1.3 low | Meta | 9.8 | 8.2 | $0.689 | 2/2 | 5.04s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 9.8 | 9.1 | $1.546 | 2/2 | 5.05s |
| #312 | gpt-oss-120b none | OpenAI | 9.8 | 3.7 | $0.010 | 2/2 | 5.06s |
| #141 | Claude Fable 5.1 low | Anthropic | 6.5 | 6.9 | $2.565 | 1/2 | 5.24s |
| #126 | Muse Glimmer 30B medium | Meta | 9.8 | 7.2 | $0.211 | 2/2 | 5.34s |
| #249 | Ling-2.6-1T none | Inclusionai | 6.4 | 5.3 | $0.016 | 1/2 | 5.36s |
| #90 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |