- 排名
- #295
- 总输出令牌
- 11,832
- 响应时间(平均)
- 22.65s
- 总成本
- $0.786
Ember-1 vs Kimi K2.5
Ember-1 平均分领先,为 5.4 vs 5.3。 Kimi K2.5 benchmark 成本更低,为 $0.262 vs $0.786。 Ember-1 更快,为 22.65s vs 35.86s,通过率为 43.5% vs 29.0%。
已对比模型
- 排名
- #299
- 总输出令牌
- 49,389
- 响应时间(平均)
- 35.86s
- 总成本
- $0.262
推荐模型
Kimi K2.5
它的得分接近这里的最高分(5.3 vs 5.4),同时成本比Ember-1低约 3.0 倍。
详细对比
| 指标 | Ember-1 Ember-1 none | Kimi K2.5 Kimi K2.5 none |
|---|---|---|
| 分数 | 5.4 | 5.3 |
| 排名 | #295 | #299 |
| 可靠性 | 8.8 | 10.0 |
| 一致性 | 8.6 | 8.6 |
| 尝试次数 | 69/69 | 69/69 |
| 测试正确 | ||
| 尝试通过率 | 43.5% | 29.0% |
| 不稳定测试 | 4 | 4 |
| 总运行次数 | 69 | 69 |
| 每个结果成本 | 9.817 | 4.976 |
| 总成本 | $0.786 | $0.262 |
| 输入价格 | $3.000 / 1M | $0.450 / 1M |
| 输出价格 | $15.000 / 1M | $2.250 / 1M |
| 缓存读取价格 | $0.300 / 1M | $0.070 / 1M |
| 缓存写入价格 | 不适用 | 不适用 |
| 总输入令牌 | 202,617 | 275,349 |
| 输出令牌 | 11,832 | 49,377 |
| 推理令牌 | 0 | 12 |
| 响应时间(平均) | 22.65s | 35.86s |
| 响应时间(最大) | 93.12s | 321.19s |
| 响应时间(总计) | 520.91s | 609.61s |
| 参数量 | ~2.8T 总计 (~104B 激活) | 1T 总计 (32B 激活) |
| 开放状态 | 闭源 | 权重可用 |
缓存价格适用于输入令牌。读取会复用已缓存的提示词;写入会存储提示词,可能产生额外费用。输出令牌按输出价格计费。
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#295 Ember-1
none- 成本
- $0.156
- 时间
- 224.6s
- 令牌
- 10,555 tok
#299 MoonshotAI: Kimi K2.5
none- 成本
- $0.015
- 时间
- 89.1s
- 令牌
- 5,421 tok
类别细分
快速对比
切换对比组合
Ember-1nonevsStep 3.5 FlashmediumGranite 4.2 8BlowvsKimi K2.5noneEmber-1nonevsHy4 previewlowNorth Mini Codemedium免费可用vsEmber-1noneEmber-1nonevsGranite 4.2 8BlowKimi K2.5nonevsStep 3.5 FlashmediumKimi K2.5nonevsHy4 previewlowKimi K2.5nonevsInkling Smalllow免费可用North Mini Codemedium免费可用vsKimi K2.5noneKimi K2.5nonevsNemotron 3.5 Lightninghigh免费可用KAT Coder AIR V2.5highvsKimi K2.5noneEmber-1nonevsInkling Smalllow免费可用