ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs Solar Pro 4 (xhigh)

Solar Pro 4 (xhigh) が平均スコアでリードし、7.7 vs 7.6 です。 GPT-5.6 Luna (medium) の benchmark コストが低く、$0.036 vs $0.049 です。 GPT-5.6 Luna (medium) の方が高速で、7.28s vs 115.81s です、成功率は 65.2% vs 65.2% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-08-11

順位
#69
合計出力トークン
43,679
応答時間(平均)
7.28s
合計コスト
$0.036
順位
#63
合計出力トークン
379,812
応答時間(平均)
115.81s
合計コスト
$0.049
おすすめモデル GPT-5.6 Luna (medium)

スコアはここでの最高値に近く(7.6 vs 7.7)、Solar Pro 4 (xhigh) より約 15.9 倍速く応答します。

詳細比較

指標 GPT-5.6 Luna GPT-5.6 Luna medium リリース: 2026-07-09 Solar Pro 4 Solar Pro 4 xhigh リリース: 2026-08-11
スコア 7.6 7.7
順位 #69 #63
信頼性 10.0 10.0
一貫性 9.6 9.4
ベンチマーク網羅率 22/22 テスト · 66/66 回 22/22 テスト · 66/66 回
正解テスト
試行ごとの合格率 65.2% 65.2%
不安定なテスト 1 2
総実行回数 66 66
結果あたりのコスト 2.513 0.374
合計コスト $0.036 $0.049
入力価格 $0.100 / 1M $0.030 / 1M
出力価格 $0.600 / 1M $0.120 / 1M
合計入力トークン 89,676 98,107
出力トークン 5,699 21,723
推論トークン 37,980 358,089
応答時間(平均) 7.28s 115.81s
応答時間(最大) 29.85s 419.47s
応答時間(合計) 160.27s 2547.92s

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.6 Luna

medium
コスト
$0.014
時間
14.6s
トークン
2,362 tok

#63 Solar Pro 4

xhigh
このモデルのショーケース結果はまだ生成されていません。
コスト
$0.000
時間
-
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Solar Pro 4 5.8 9.9 33.3% 0 292.21s 7,887 15,575 115,426

クイック比較

比較ペアを切り替え