导航
AI BENCHY
Advertise here

Nemotron 3.5 Lightning (medium) vs Laguna XS 2.1

Laguna XS 2.1 平均分领先,为 5.3 vs 5.2Laguna XS 2.1 benchmark 成本更低,为 $0.008 vs $0.193Laguna XS 2.1 更快,为 1.55s vs 69.64s,通过率为 47.0% vs 30.3%

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-08-11

排名
#208
总输出令牌
741,084
响应时间(平均)
69.64s
总成本
$0.193
排名
#203
总输出令牌
13,377
响应时间(平均)
1.55s
总成本
$0.008
推荐模型 Laguna XS 2.1

它在这里得分最高(5.3),同时成本比Nemotron 3.5 Lightning (medium)低约 27.1 倍。

详细对比

指标 Nemotron 3.5 Lightning Nemotron 3.5 Lightning medium 发布日期: 2026-08-11 免费可用 Laguna XS 2.1 Laguna XS 2.1 none 发布日期: 2026-07-02 免费可用
分数 5.2 5.3
排名 #208 #203
可靠性 9.9 10.0
一致性 6.4 9.0
基准测试覆盖率 22/22 项测试 · 66/66 次尝试 22/22 项测试 · 66/66 次尝试
测试正确
尝试通过率 47.0% 30.3%
不稳定测试 10 3
总运行次数 66 66
每个结果成本 0.000 0.143
总成本 $0.193 $0.008
输入价格 $0.100 / 1M $0.060 / 1M
输出价格 $0.250 / 1M $0.120 / 1M
总输入令牌 126,321 91,598
输出令牌 156,554 13,377
推理令牌 584,530 0
响应时间(平均) 69.64s 1.55s
响应时间(最大) 437.11s 19.02s
响应时间(总计) 1532.18s 34.19s

模型生成展示

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Nemotron 3.5 Lightning

medium
此模型尚未生成任何展示结果。
成本
$0.000
时间
-
令牌
0 tok

#203 Laguna XS 2.1

none
成本
$0.001
时间
27.6s
令牌
4,344 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Nemotron 3.5 Lightning 4.4 5.1 33.3% 2 285.47s 7,623 78,065 297,359
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0

快速对比

切换对比组合