【发布时间】:2016-08-23 09:34:51
【问题描述】:
“BacDive”的资源 - (http://bacdive.dsmz.de/) 是一个非常有用的数据库,用于访问细菌知识,例如菌株信息、物种信息和参数,例如最佳生长温度。
我有一个场景,我在纯文本文件中有一组有机体名称,我想以编程方式对 Bacdive 数据库(不允许下载平面文件)逐一搜索并检索相关信息并相应地填充我的文本文件。
我需要哪些主要模块(例如 beautifulsoups)来完成此任务?它是直截了当的吗?是否允许以编程方式访问网页?我需要许可吗?
细菌名称应该是“恶臭假单胞菌”。搜索这将在 bacdive 上获得 60 次点击。单击其中一个点击,将我们带到特定页面,其中行:“生长温度:[Ref.:#27] 推荐的生长温度:26°C”是最重要的。
脚本必须访问 bacdive(我曾尝试使用 requests 访问,但我觉得他们不允许编程访问,我已经向版主询问了这个问题,他们说我应该先注册他们的 API)。
我现在拥有 API 访问权限。这是页面 (http://www.bacdive.dsmz.de/api/bacdive/)。对于进行 HTML 抓取的人来说,这可能看起来很简单,但现在我可以访问 API,我不确定该怎么做。
【问题讨论】:
-
您能否给我们任何细菌的名称(您必须搜索的平面文件中的文本),以便我们提供帮助。我的建议是使用 requests 和 lxml 从结果中提取数据。告诉我们确切的要求。谢谢
-
请注意访问标签上写着“不要使用这个标签”
-
@Fionnuala ,我已经删除了“访问”标签。
-
@A.Chandu,我已经编辑并添加了一个细菌示例。
-
嗨,我成功获得了 60 个结果...现在我应该点击哪个链接来获取信息??
标签: python database webpage bioinformatics