【发布时间】:2021-01-05 03:51:10
【问题描述】:
我有一个 snakemake 管道,其中包含调用其他程序和自定义 R 和 python 脚本的规则。
我有多个数据集,需要在这些数据集上运行同一管道。通常我会为每个数据集创建一个单独的文件夹,并放置一个特定于数据集的配置文件并单独运行。
由于这次我有 20 多个数据集,我想知道是否有更自动化的方法来执行此操作。数据集之间主要有 4 个参数发生变化:输入文件位置、引物、质量控制参数和结果的输出目录。 有没有办法拥有一个“主”配置文件,其中包含关于这 4 个参数的信息和一个蛇文件,然后调用第二个蛇文件的次数与数据集的数量一样多?
这整个想法对我来说似乎是一个 for 循环,它遍历这 4 个参数的数组,但我不知道如何在蛇形中实现它。
欢迎任何建议和想法! 谢谢 赫娜
【问题讨论】:
-
subworkflow适合你吗?
标签: snakemake