导航
AI BENCHY
Advertise here

GPT-5.6 Luna (high) vs Solar Pro 4 (xhigh)

平均分几乎持平,为 7.7 vs 7.7Solar Pro 4 (xhigh) benchmark 成本更低,为 $0.049 vs $0.102GPT-5.6 Luna (high) 更快,为 18.68s vs 115.81s,通过率为 72.7% vs 65.2%

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-08-11

排名
#62
总输出令牌
155,998
响应时间(平均)
18.68s
总成本
$0.102
排名
#63
总输出令牌
379,812
响应时间(平均)
115.81s
总成本
$0.049
推荐模型 GPT-5.6 Luna (high)

它在这里得分最高(7.7),同时响应速度比Solar Pro 4 (xhigh)快约 6.2 倍。

详细对比

指标 GPT-5.6 Luna GPT-5.6 Luna high 发布日期: 2026-07-09 Solar Pro 4 Solar Pro 4 xhigh 发布日期: 2026-08-11
分数 7.7 7.7
排名 #62 #63
可靠性 10.0 10.0
一致性 8.9 9.4
基准测试覆盖率 22/22 项测试 · 66/66 次尝试 22/22 项测试 · 66/66 次尝试
测试正确
尝试通过率 72.7% 65.2%
不稳定测试 3 2
总运行次数 66 66
每个结果成本 6.780 0.374
总成本 $0.102 $0.049
输入价格 $0.100 / 1M $0.030 / 1M
输出价格 $0.600 / 1M $0.120 / 1M
总输入令牌 80,918 98,107
输出令牌 5,088 21,723
推理令牌 150,910 358,089
响应时间(平均) 18.68s 115.81s
响应时间(最大) 111.09s 419.47s
响应时间(总计) 411.05s 2547.92s

模型生成展示

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.6 Luna

high
成本
$0.033
时间
34.2s
令牌
5,484 tok

#63 Solar Pro 4

xhigh
此模型尚未生成任何展示结果。
成本
$0.000
时间
-
令牌
0 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Solar Pro 4 5.8 9.9 33.3% 0 292.21s 7,887 15,575 115,426

快速对比

切换对比组合