- 排名
- #78
- 总输出令牌
- 391,540
- 响应时间(平均)
- 109.98s
- 总成本
- $0.831
Kimi K2.6 (medium) vs Grok 4.3 (medium)
Kimi K2.6 (medium) 平均分领先,为 7.2 vs 7.1。 Grok 4.3 (medium) benchmark 成本更低,为 $0.779 vs $0.831。 Grok 4.3 (medium) 更快,为 47.45s vs 109.98s,通过率为 63.6% vs 68.2%。
- 排名
- #83
- 总输出令牌
- 241,421
- 响应时间(平均)
- 47.45s
- 总成本
- $0.779
推荐模型
Grok 4.3 (medium)
它的得分接近这里的最高分(7.1 vs 7.2),同时响应速度比Kimi K2.6 (medium)快约 2.3 倍。
详细对比
| 指标 | Kimi K2.6 Kimi K2.6 medium | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| 分数 | 7.2 | 7.1 |
| 排名 | #78 | #83 |
| 可靠性 | 9.4 | 10.0 |
| 一致性 | 8.3 | 8.6 |
| 测试正确 | ||
| 尝试通过率 | 63.6% | 68.2% |
| 不稳定测试 | 4 | 4 |
| 总运行次数 | 66 | 66 |
| 每个结果成本 | 9.821 | 5.990 |
| 总成本 | $0.831 | $0.779 |
| 输入价格 | $0.646 / 1M | $1.250 / 1M |
| 输出价格 | $2.720 / 1M | $2.500 / 1M |
| 总输入令牌 | 68,902 | 140,031 |
| 输出令牌 | 111,680 | 13,739 |
| 推理令牌 | 279,860 | 227,682 |
| 响应时间(平均) | 109.98s | 47.45s |
| 响应时间(最大) | 876.20s | 216.69s |
| 响应时间(总计) | 2309.56s | 1043.83s |
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#78 MoonshotAI: Kimi K2.6
medium- 成本
- $0.013
- 时间
- 103.4s
- 令牌
- 3,620 tok
#83 xAI: Grok 4.3
medium- 成本
- $0.009
- 时间
- 19.0s
- 令牌
- 3,661 tok
按分数排名的模型
分数 vs 总成本
响应时间(平均)
分数 vs 响应时间(平均)
总输出令牌
分数 vs 总输出令牌
类别细分
快速对比
切换对比组合
KAT-Coder-Pro V2.5highvsKimi K2.6mediumKimi K2.6mediumvsStep 3.7 FlashlowQwen3.7 PlusnonevsGrok 4.3mediumClaude Opus 4.8nonevsKimi K2.6mediumKimi K2.6mediumvsQwen3.7 FlashlowKimi K2.6mediumvsQwen3.7 PlusnoneKAT-Coder-Pro V2.5highvsGrok 4.3mediumClaude Sonnet 4.6nonevsKimi K2.6mediumStep 3.7 FlashlowvsGrok 4.3mediumClaude Opus 4.8nonevsGrok 4.3mediumKAT-Coder-Pro V2.5lowvsKimi K2.6mediumQwen3.7 FlashlowvsGrok 4.3medium