- 排名
- #353
- 总输出令牌
- 0
- 响应时间(平均)
- 86.95s
- 总成本
- $0.000
Command A+ — high 对比 none
平均分几乎持平,为 3.0 vs 3.0。 benchmark 成本几乎持平,为 $0.000 vs $0.000。 none 更快,为 81.36s vs 86.95s,通过率为 0.0% vs 0.0%。
已对比模型
- 排名
- #356
- 总输出令牌
- 0
- 响应时间(平均)
- 81.36s
- 总成本
- $0.000
推荐模型
none
它在本次比较中得分最高(3.0),并且在全部 2 个模型中兼顾成本和响应时间最好。
详细对比
| 指标 | Command A+ Command A+ high | Command A+ Command A+ none |
|---|---|---|
| 分数 | 3.0 | 3.0 |
| 排名 | #353 | #356 |
| 可靠性 | 0.0 | 0.0 |
| 一致性 | 10.0 | 10.0 |
| 尝试次数 | 66/66 | 66/66 |
| 测试正确 | ||
| 尝试通过率 | 0.0% | 0.0% |
| 不稳定测试 | 0 | 0 |
| 总运行次数 | 66 | 66 |
| 每个结果成本 | 0.000 | 0.000 |
| 总成本 | $0.000 | $0.000 |
| 输入价格 | $0.300 / 1M | $0.300 / 1M |
| 输出价格 | $1.500 / 1M | $1.500 / 1M |
| 总输入令牌 | 0 | 0 |
| 输出令牌 | 0 | 0 |
| 推理令牌 | 0 | 0 |
| 响应时间(平均) | 86.95s | 81.36s |
| 响应时间(最大) | 114.87s | 106.37s |
| 响应时间(总计) | 1913.01s | 1789.98s |
| 参数量 | 218B 总计 (25B 激活) | 218B 总计 (25B 激活) |
| 开放状态 | 开源 | 开源 |
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#353 Command A+
high
Provider returned error
- 成本
- $0.000
- 时间
- 0.2s
- 令牌
- 0 tok
#356 Command A+
none
Provider returned error
- 成本
- $0.000
- 时间
- 0.2s
- 令牌
- 0 tok
按分数排名的模型
分数 vs 总成本
响应时间(平均)
分数 vs 响应时间(平均)
总输出令牌
分数 vs 总输出令牌
类别细分
| 反AI技巧 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 85.94s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 90.54s | 0 | 0 | 0 |
| 编程 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 92.74s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 80.82s | 0 | 0 | 0 |
| 综合 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 80.65s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 46.61s | 0 | 0 | 0 |
| 数据解析与提取 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 86.20s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 62.59s | 0 | 0 | 0 |
| 领域专项 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 67.89s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 90.26s | 0 | 0 | 0 |
| 通用智能 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 99.30s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 84.05s | 0 | 0 | 0 |
| 指令遵循 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 110.33s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 95.73s | 0 | 0 | 0 |
| 谜题求解 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 86.20s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 88.10s | 0 | 0 | 0 |
| 工具调用 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 84.61s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 81.86s | 0 | 0 | 0 |
| 常识问答 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 90.50s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 74.52s | 0 | 0 | 0 |
快速对比
切换对比组合
Command A+highvsJev 1.13noneCommand A+highvsgpt-oss-120bnone免费可用Command A+highvsLing 3.0 TinymediumCommand A+nonevsLing 3.0 TinymediumCommand A+highvsQwen3.5-9BmediumCommand A+nonevsQwen3.5-9BmediumCommand A+highvsLing 3.0 TinylowCommand A+nonevsLing 3.0 TinylowCommand A+nonevsLing 3.0 TinyhighCommand A+highvsMercury 2.5noneCommand A+highvsNemotron 3.5 Lightningnone免费可用Command A+highvsGranite 4.1 8Bnone