ナビゲーション
Advertise here

GPT-6 Luna Decisions (default) vs Decider V1.1 27B (default)

Decider V1.1 27B (default) が平均スコアでリードし、2.6 vs 2.4 です。 Decider V1.1 27B (default) の benchmark コストが低く、$0.002 vs $0.005 です。 Decider V1.1 27B (default) の方が高速で、320ms vs 495ms です、成功率は 13.0% vs 17.4% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-07

比較対象モデル

順位
#396
合計出力トークン
0
応答時間(平均)
495ms
合計コスト
$0.005
順位
#395
合計出力トークン
69
応答時間(平均)
320ms
合計コスト
$0.002
おすすめモデル Decider V1.1 27B (default)

ここでは最高スコア(2.6)で、GPT-6 Luna Decisions (default) より約 3.2 倍低コストです。

詳細比較

指標 GPT-6 Luna Decisions GPT-6 Luna Decisions default リリース: 2026-10-07 Decider V1.1 27B Decider V1.1 27B default リリース: 2026-10-07
スコア 2.4 2.6
順位 #396 #395
信頼性 10.0 10.0
一貫性 5.2 5.2
試行回数 36/69 36/69
正解テスト
試行ごとの合格率 13.0% 17.4%
不安定なテスト 0 0
総実行回数 36 36
結果あたりのコスト 0.159 0.037
合計コスト $0.005 $0.002
入力価格 $0.100 / 1M $0.020 / 1M
出力価格 $0.000 / 1M $0.000 / 1M
キャッシュ読み取り料金 $0.000 / 1M 該当なし
キャッシュ書き込み料金 $0.000 / 1M 該当なし
合計入力トークン 47,583 73,557
出力トークン 0 69
推論トークン 0 0
応答時間(平均) 495ms 320ms
応答時間(最大) 842ms 491ms
応答時間(合計) 5.94s 3.84s
パラメータ ~400B 総数 (~17B アクティブ) 27B
公開状況 クローズド オープンソース

キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

比較ペアを切り替え

Command A+lowvsDecider V1.1 27BdefaultCommand A+nonevsDecider V1.1 27BdefaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsDecider V1.1 27BdefaultGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20noneCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20none