指示追従 ランキング
指示追従 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 合計コスト ↓.
316/316
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 指示追従 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #308 | Grok 4.1 Fast none | X AI | 3.0 | 3.8 | $0.008 | 0/2 | 685ms |
| #247 | Laguna XS 2.1 none | Poolside | 3.8 | 5.3 | $0.008 | 0/2 | 364ms |
| #300 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.007 | 1/2 | 13.0s |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 6.5 | 4.0 | $0.007 | 1/2 | 511ms |
| #303 | Granite 4.1 8B none | IBM Granite | 3.6 | 4.0 | $0.007 | 0/2 | 344ms |
| #236 | Qwen3.8 27B none | Qwen | 6.3 | 5.5 | ~$0.006 | 1/2 | 582ms |
| #215 | Solar Pro 4 none | Upstage | 6.4 | 5.8 | $0.006 | 1/2 | 1.67s |
| #311 | Laguna Xs.2 none | Poolside | 6.5 | 3.8 | $0.004 | 1/2 | 439ms |
| #220 | Ling-3.0-flash none | Inclusionai | 4.8 | 5.7 | $0.004 | 0/2 | 836ms |
| #271 | Ling-2.6-flash none | Inclusionai | 9.8 | 4.9 | $0.002 | 2/2 | 5.52s |
| #316 | LFM2-24B-A2B none | Liquid | 6.3 | 2.2 | $0.001 | 1/2 | 752ms |
| #175 | Dots 3 Note Preview low | Dots Studio | 7.9 | 6.4 | $0.000 | 1/2 | 7.83s |
| #176 | Dots 3 Note Preview high | Dots Studio | 8.3 | 6.4 | $0.000 | 1/2 | 7.80s |
| #208 | Dots 3 Note Preview medium | Dots Studio | 8.5 | 5.9 | $0.000 | 1/2 | 7.77s |
| #216 | North Mini Code medium | Cohere | 9.8 | 5.7 | $0.000 | 2/2 | 15.4s |