- 排名
- #353
- 总输出令牌
- 0
- 响应时间(平均)
- 86.95s
- 总成本
- $0.000
Command A+ — high 对比 low
平均分几乎持平,为 3.0 vs 3.0。 benchmark 成本几乎持平,为 $0.000 vs $0.000。 high 更快,为 86.95s vs 90.86s,通过率为 0.0% vs 0.0%。
已对比模型
- 排名
- #354
- 总输出令牌
- 0
- 响应时间(平均)
- 90.86s
- 总成本
- $0.000
推荐模型
high
它在本次比较中得分最高(3.0),并且在全部 2 个模型中兼顾成本和响应时间最好。
详细对比
| 指标 | Command A+ Command A+ high | Command A+ Command A+ low |
|---|---|---|
| 分数 | 3.0 | 3.0 |
| 排名 | #353 | #354 |
| 可靠性 | 0.0 | 0.0 |
| 一致性 | 10.0 | 10.0 |
| 尝试次数 | 66/66 | 66/66 |
| 测试正确 | ||
| 尝试通过率 | 0.0% | 0.0% |
| 不稳定测试 | 0 | 0 |
| 总运行次数 | 66 | 66 |
| 每个结果成本 | 0.000 | 0.000 |
| 总成本 | $0.000 | $0.000 |
| 输入价格 | $0.300 / 1M | $0.300 / 1M |
| 输出价格 | $1.500 / 1M | $1.500 / 1M |
| 总输入令牌 | 0 | 0 |
| 输出令牌 | 0 | 0 |
| 推理令牌 | 0 | 0 |
| 响应时间(平均) | 86.95s | 90.86s |
| 响应时间(最大) | 114.87s | 116.28s |
| 响应时间(总计) | 1913.01s | 1998.86s |
| 参数量 | 218B 总计 (25B 激活) | 218B 总计 (25B 激活) |
| 开放状态 | 开源 | 开源 |
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#353 Command A+
high
Provider returned error
- 成本
- $0.000
- 时间
- 0.2s
- 令牌
- 0 tok
#354 Command A+
low
Provider returned error
- 成本
- $0.000
- 时间
- 0.2s
- 令牌
- 0 tok
按分数排名的模型
分数 vs 总成本
响应时间(平均)
分数 vs 响应时间(平均)
总输出令牌
分数 vs 总输出令牌
类别细分
| 反AI技巧 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 85.94s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 87.46s | 0 | 0 | 0 |
| 编程 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 92.74s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 86.43s | 0 | 0 | 0 |
| 综合 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 80.65s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 83.53s | 0 | 0 | 0 |
| 数据解析与提取 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 86.20s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 85.39s | 0 | 0 | 0 |
| 领域专项 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 67.89s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 82.74s | 0 | 0 | 0 |
| 通用智能 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 99.30s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 101.81s | 0 | 0 | 0 |
| 指令遵循 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 110.33s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 105.69s | 0 | 0 | 0 |
| 谜题求解 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 86.20s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 95.76s | 0 | 0 | 0 |
| 工具调用 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 84.61s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 99.68s | 0 | 0 | 0 |
| 常识问答 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 90.50s | 0 | 0 | 0 | |
| Command A+ | 3.0 | 10.0 | 0.0% | 0 | 103.52s | 0 | 0 | 0 |
快速对比
切换对比组合
Command A+highvsJev 1.13noneCommand A+lowvsJev 1.13noneCommand A+highvsgpt-oss-120bnone免费可用Command A+lowvsgpt-oss-120bnone免费可用Command A+highvsLing 3.0 TinymediumCommand A+lowvsLing 3.0 TinymediumCommand A+highvsQwen3.5-9BmediumCommand A+lowvsQwen3.5-9BmediumCommand A+highvsLing 3.0 TinylowCommand A+lowvsLing 3.0 TinyhighCommand A+highvsMercury 2.5noneCommand A+lowvsMercury 2.5none