Vee*_*era 6 wildcard snakemake
在以下示例中,将在与输入文件相同的位置创建输出文件。有没有办法在输出部分获取通配符值的基本名称,以便我可以使用输入文件的基本名称来命名输出文件,但将其写入不同的位置?
infile=['/home/user/folder1/file1','/home/user/folder2/file2/']
rule one:
input: expand("{myfile}", myfile = infile)
output: "{myfile}" + ".out"
shell: "touch {wildcards.myfile}.out"
Run Code Online (Sandbox Code Playgroud)
在 Snakemake 中有一个简单的方法可以使用lambda在 Snakemake 中使用Python 函数
首先,您应该创建一个文件字典,以文件名作为键,以路径作为值的文件,如下所示:
files = {'filesA' : 'path/to/fileA.ext', 'filesB' : 'path/to/fileB.ext'}
Run Code Online (Sandbox Code Playgroud)
该字典可以位于蛇文件中或配置文件中。我建议把它放在配置文件中并这样调用config['dict_name']
lambda现在让我们使用function编写规则:
rule all :
input :
#If you want to create in a different directory use this,
#but it has to be like output from rule one.
#expand('{directory}{filename}{extension}',
#directory = 'path/to/newdir',
#filename = config['dictname'].keys(),
#extension = '.out')
#Otherwise
expand('{filename}{extension}',
filename = config['dictname'].keys(),
extension = '.out')
rule one:
input: lambda wildcards: config['dictname'][wildcards.input]
output: "{input}" + ".out"
message: "Executing one using {input}"
shell: "touch {input}.out"
Run Code Online (Sandbox Code Playgroud)
在代码中,您有两个规则,第一个调用的规则all将被执行。因此,当您启动时,snakemake它将想要获取与创建的列表相对应的文件列表expand。
Snakemake 将查看规则是否生成该文件列表,如果不是,它将在目录中搜索它们。expand正如您所看到的,您可以使用目录、文件名、后缀、前缀、扩展名等指定您想要的一切。
在这个例子中,Snakemake想要一些文件名是键字典和扩展名的文件.out。该规则one是产生它们的完美规则。
该规则的one工作原理如下:对于字典的每个键,都将执行该规则。输入部分中的 lambda 函数就起到了这个作用。根据记录,通配符可以被称为任何你想要的,input这只是一个例子。
为了更优雅,您可以将 lambda 函数的内容放入变量中,如下所示:
_input_One = lambda wildcards: config['dictname'][wildcards.input]
Run Code Online (Sandbox Code Playgroud)
然后像这样编写规则一输入:
input: _input_One
Run Code Online (Sandbox Code Playgroud)
有关更多信息,请查看https://snakemake.readthedocs.io/en/stable/上的文档
雨果