ナビゲーション
Advertise here

Kev 4B (default) vs GPT-6 Luna Decisions (default)

平均スコアは 2.4 vs 2.4 でほぼ同等です。 Kev 4B (default) の benchmark コストが低く、$0.002 vs $0.005 です。 GPT-6 Luna Decisions (default) の方が高速で、495ms vs 5.63s です、成功率は 15.9% vs 13.0% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-07

比較対象モデル

順位
#391
合計出力トークン
28,061
応答時間(平均)
5.63s
合計コスト
$0.002
順位
#390
合計出力トークン
0
応答時間(平均)
495ms
合計コスト
$0.005
おすすめモデル GPT-6 Luna Decisions (default)

ここでは最高スコア(2.4)で、Kev 4B (default) より約 11.4 倍速く応答します。

詳細比較

指標 Kev 4B Kev 4B default リリース: 2026-09-28 GPT-6 Luna Decisions GPT-6 Luna Decisions default リリース: 2026-10-07
スコア 2.4 2.4
順位 #391 #390
信頼性 10.0 10.0
一貫性 4.9 5.2
試行回数 36/69 36/69
正解テスト
試行ごとの合格率 15.9% 13.0%
不安定なテスト 1 0
総実行回数 36 36
結果あたりのコスト 0.060 0.159
合計コスト $0.002 $0.005
入力価格 $0.042 / 1M $0.100 / 1M
出力価格 $0.000 / 1M $0.000 / 1M
キャッシュ読み取り料金 該当なし $0.000 / 1M
キャッシュ書き込み料金 該当なし $0.000 / 1M
合計入力トークン 42,804 47,583
出力トークン 28,061 0
推論トークン 0 0
応答時間(平均) 5.63s 495ms
応答時間(最大) 17.79s 842ms
応答時間(合計) 67.61s 5.94s
パラメータ 4B ~400B 総数 (~17B アクティブ)
公開状況 オープンソース クローズド

キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

クイック比較

比較ペアを切り替え

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+lowvsKev 4BdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+highvsKev 4BdefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneCommand A+mediumvsKev 4BdefaultKev 4BdefaultvsGrok 4.20none