【发布时间】:2011-10-20 23:35:01
【问题描述】:
我正在尝试使用 python 运行 awk 脚本,以便处理一些数据。
有没有办法让 awk 脚本在 python 类中运行,而不使用系统类来调用它作为 shell 进程?我运行这些 python 脚本的框架不允许使用子进程调用,所以我要么想办法在 python 中转换我的 awk 脚本,要么在可能的情况下在 python 中运行 awk 脚本。
有什么建议吗?我的 awk 脚本基本上读取一个文本文件并隔离包含特定化合物的蛋白质块(输出由我们的框架生成;我在下面添加了一个示例,说明它的外观)并将它们隔离并打印出来不同的文件。
buildProtein compoundA compoundB
begin fusion
Calculate : (lots of text here on multiple lines)
(more lines)
Final result - H20: value CO2: value Compound: value
Other Compounds X: Value Y: value Z:value
[...another similar block]
例如,如果我构建了一种蛋白质,我需要查看最终结果行中是否有 CH3COOH,如果有,我必须从命令“buildProtein”开始获取整个块,直到下一个区块的开始;并将其保存在文件中;然后移动到下一个,看看它是否有我正在寻找的化合物......如果没有,我跳到下一个,直到文件末尾(文件有多次出现的化合物我搜索,有时它们是连续的,而有时它们与没有化合物的块交替。
我们非常欢迎任何帮助;现在我头疼了几个星期,在发现这个网站后,我决定寻求一些帮助。
提前感谢您的好意!
【问题讨论】: