导航
AI BENCHY
Advertise here

AI BENCHY 对比

Anthropic: Claude Opus 4.7 vs Tencent: Hy3 preview

摘要

Claude Opus 4.7 vs Hy3 preview benchmark 对比:Claude Opus 4.7 平均分领先,为 7.4 vs 6.8Hy3 preview benchmark 成本更低,为 $0.059 vs $0.505Claude Opus 4.7 更快,为 3.02s vs 56.57s,通过率为 76.2% vs 55.6%

推荐模型: Claude Opus 4.7 - 它在这里得分最高(7.4),同时响应速度比Hy3 preview快约 18.7 倍。

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-06-18

指标 Claude Opus 4.7 Claude Opus 4.7 none 发布日期: 2026-04-16 Hy3 preview Hy3 preview high 发布日期: 2026-04-22
分数 7.4 6.8
排名 #49 #74
可靠性 10.0 10.0
一致性 9.0 9.2
测试正确
尝试通过率 76.2% 55.6%
不稳定测试 0 2
总运行次数 57 63
每个结果成本 3.154 0.000
总成本 $0.505 $0.059
输入价格 $5.000 / 1M $0.066 / 1M
输出价格 $25.000 / 1M $0.260 / 1M
总输入令牌 69,576 25,987
输出令牌 6,265 216,719
推理令牌 0 0
响应时间(平均) 3.02s 56.57s
响应时间(最大) 18.27s 149.94s
响应时间(总计) 57.44s 848.59s

生成展示

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 Claude Opus 4.7

none
成本
$0.051
时间
24.2s
令牌
2,181 tok

#74 Hy3 preview

high
Hy3 preview is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/tencent/hy3-preview
成本
$0.000
时间
0.0s
令牌
0 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

反AI技巧 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 894 522 0
Hy3 preview 6.4 7.9 58.3% 1 15.12s 373 6,839 0
编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 3.3 3.3 33.3% 0 2.84s 1,176 494 0
Hy3 preview 5.3 10.0 33.3% 0 99.76s 741 38,167 0
综合 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 37,740 3,504 0
Hy3 preview 10.0 10.0 100.0% 0 113.09s 13,119 31,319 0
数据解析与提取 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 10,533 324 0
Hy3 preview 6.5 10.0 50.0% 0 12.11s 2,316 4,323 0
领域专项 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 1,020 78 0
Hy3 preview 5.3 7.2 44.4% 1 109.04s 747 87,559 0
通用智能 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 723 257 0
Hy3 preview 3.0 10.0 0.0% 0 0ms 0 0 0
指令遵循 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 939 114 0
Hy3 preview 10.0 10.0 100.0% 0 34.36s 675 13,483 0
谜题求解 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 10.0 10.0 100.0% 0 2.46s 939 597 0
Hy3 preview 7.7 10.0 66.7% 0 27.94s 390 15,567 0
工具调用 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 15,339 372 0
Hy3 preview 10.0 10.0 100.0% 0 78.83s 7,410 10,370 0
常识问答 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Claude Opus 4.7 3.0 10.0 0.0% 0 1.46s 273 3 0
Hy3 preview 3.0 10.0 0.0% 0 47.71s 216 9,092 0

快速对比

切换对比组合