导航
AI BENCHY
Advertise here

AI BENCHY 对比

IBM: Granite 4.1 8B vs MiniMax: MiniMax M2.7

摘要

Granite 4.1 8B vs MiniMax M2.7 benchmark 对比:MiniMax M2.7 平均分领先,为 5.2 vs 4.0Granite 4.1 8B benchmark 成本更低,为 $0.003 vs $0.104Granite 4.1 8B 更快,为 728ms vs 38.18s,通过率为 9.5% vs 46.0%

推荐模型: Granite 4.1 8B - 它提供了最佳整体取舍:得分有竞争力(4.0),成本低于MiniMax M2.7,响应时间也较均衡。

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-06-12

指标 Granite 4.1 8B Granite 4.1 8B none 发布日期: 2026-05-01 MiniMax M2.7 MiniMax M2.7 medium 发布日期: 2026-03-18
分数 4.0 5.2
排名 #163 #134
可靠性 10.0 10.0
一致性 10.0 6.8
测试正确
尝试通过率 9.5% 46.0%
不稳定测试 0 8
总运行次数 63 63
每个结果成本 0.131 2.494
总成本 $0.003 $0.104
输入价格 $0.050 / 1M $0.250 / 1M
输出价格 $0.100 / 1M $1.000 / 1M
总输入令牌 46,285 34,371
输出令牌 2,911 8,981
推理令牌 0 89,812
响应时间(平均) 728ms 38.18s
响应时间(最大) 2.17s 196.21s
响应时间(总计) 15.29s 763.60s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 IBM: Granite 4.1 8B

none
Cost
$0.001
Time
3.2s
Tokens
491 tok

#134 MiniMax M2.7

medium
Cost
$0.022
Time
22.8s
Tokens
9,250 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

反AI技巧 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 645 903 0
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
综合 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 19,089 396 0
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
数据解析与提取 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 7,617 195 0
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
领域专项 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 768 24 0
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
通用智能 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 528 115 0
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
指令遵循 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 687 66 0
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
谜题求解 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.2 10.0 0.0% 0 608ms 672 432 0
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
工具调用 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 7,719 243 0
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
常识问答 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Granite 4.1 8B 3.0 10.0 0.0% 0 306ms 216 12 0
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452

快速对比

切换对比组合