ナビゲーション
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Jev 1.13 (default)

Jev 1.13 (default) が平均スコアでリードし、2.6 vs 2.4 です。 Jev 1.13 (default) の benchmark コストが低く、$0.003 vs $0.005 です。 GPT-6 Luna Decisions (default) の方が高速で、495ms vs 698ms です、成功率は 13.0% vs 26.1% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-07

比較対象モデル

順位
#390
合計出力トークン
0
応答時間(平均)
495ms
合計コスト
$0.005
順位
#389
合計出力トークン
18,927
応答時間(平均)
698ms
合計コスト
$0.003
おすすめモデル Jev 1.13 (default)

ここでは最高スコア(2.6)で、GPT-6 Luna Decisions (default) より約 1.7 倍低コストです。

詳細比較

指標 GPT-6 Luna Decisions GPT-6 Luna Decisions default リリース: 2026-10-07 Jev 1.13 Jev 1.13 default リリース: 2026-09-18
スコア 2.4 2.6
順位 #390 #389
信頼性 10.0 10.0
一貫性 5.2 5.2
試行回数 36/69 36/69
正解テスト
試行ごとの合格率 13.0% 26.1%
不安定なテスト 0 0
総実行回数 36 36
結果あたりのコスト 0.159 0.047
合計コスト $0.005 $0.003
入力価格 $0.100 / 1M $0.042 / 1M
出力価格 $0.000 / 1M $0.000 / 1M
キャッシュ読み取り料金 $0.000 / 1M 該当なし
キャッシュ書き込み料金 $0.000 / 1M 該当なし
合計入力トークン 47,583 67,092
出力トークン 0 18,927
推論トークン 0 0
応答時間(平均) 495ms 698ms
応答時間(最大) 842ms 1.08s
応答時間(合計) 5.94s 8.38s
パラメータ ~400B 総数 (~17B アクティブ) -
公開状況 クローズド クローズド

キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Jev 1.13 2.2 6.7 0.0% 0 598ms 30,072 8,130 0

クイック比較

比較ペアを切り替え

Command A+lowvsJev 1.13defaultCommand A+nonevsJev 1.13defaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+highvsJev 1.13defaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+mediumvsJev 1.13defaultJev 1.13defaultvsGrok 4.20noneGemini 3 Flash PreviewhighvsJev 1.13defaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20none