- 分数
- 9.4 (+3.21 分)
- 总成本(当前价格)
- $0.183 · 便宜 87.5%
- 响应时间(平均)
- 6.24s · 快 97.6%
Mistral
发布日期: 2026-10-06
测试于: 2026-10-06 19:26
mistralai/mistral-large-4-0::medium
1.05T 总计 (49B 激活)MoE闭源
摘要
Mistral Large 4 在 AI BENCHY 上得分 6.2,排名 #240。它的可靠性为 9.2,通过率为 55.1%,总成本为 $1.456,平均响应时间为 265.03s。
Mistral Large 4 的独特之处: 它最突出的是 综合,排名 #3;相对较弱的是 通用智能,排名 #16。 它使用的推理 token 明显偏高,这可能解释较慢或成本更高的运行。
推荐替代模型
建议改用以下模型之一:
- 分数
- 6.2 (+0.03 分)
- 总成本(当前价格)
- $0.090 · 便宜 93.9%
- 响应时间(平均)
- 3.60s · 快 98.6%
- 分数
- 9.6 (+3.41 分)
- 总成本(当前价格)
- $0.460 · 便宜 68.4%
- 响应时间(平均)
- 7.15s · 快 97.3%
模型信息
调研日期:2026-10-06
- 参数量
- 1.05T 总计 (49B 激活)
- 架构
- MoE
- 开放状态
- 闭源
- 许可证
- -
输入价格
$0.680 / 1M
输出价格
$2.090 / 1M
缓存读取价格
$0.070 / 1M
缓存写入价格
不适用
缓存价格适用于输入令牌。读取会复用已缓存的提示词;写入会存储提示词,可能产生额外费用。输出令牌按输出价格计费。
不稳定测试
7
不稳定测试在运行之间出现混合结果(至少一次通过且至少一次失败)。
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#240 Mistral Large 4
medium- 成本
- $0.011
- 时间
- 63.4s
- 令牌
- 5,291 tok
图表
先选择第一个模型,再点击第二个模型打开并排页面。
快速对比
Mistral Large 4mediumvsClaude Fable 5.1lowMistral Large 4mediumvsGemini 3.5 FlashnoneMistral Large 4mediumvsGemini 3.1 Flash Lite PreviewnoneMistral Large 4mediumvsTrinity Large ThinkingmediumMistral Large 4mediumvsDeepSeek V4 Flash 0731noneMistral Large 4mediumvsApodex 1.1 Minilow免费可用Mistral Large 4mediumvsKAT-Coder-Pro V2.5mediumMistral Large 4mediumvsInklingnone免费可用Mistral Large 4mediumvsSpace Bunny AlphaxhighMistral Large 4mediumvsQwen3.5 Plus 2026-04-20none