【发布时间】:2017-05-10 08:20:48
【问题描述】:
我是网络抓取的新手。我正在尝试从here 获取 FASTA 文件,但不知何故我不能。首先是我的跨度标签问题,我尝试了一些建议但对我不起作用我怀疑可能存在隐私问题
这个类中的 FASTA 文件,但是当我运行这段代码时,我只能看到 FASTA 标题:
url = "https://www.ncbi.nlm.nih.gov/nuccore/193211599?report=fasta"
res = requests.get(url)
soup = BeautifulSoup(res.text, "html.parser")
fasta_data = soup.find_all("div")
for link in soup.find_all("div", {"class": "seqrprt seqviewer"}):
print link.text
url = "https://www.ncbi.nlm.nih.gov/nuccore/193211599?report=fasta"
res = requests.get(url)
soup = BeautifulSoup(res.text, "html.parser")
fasta_data = soup.find_all("div")
for link in soup.find_all("div", {"class": "seqrprt seqviewer"}):
print link.text
##When I try to reach directly via span, output is empty.
div = soup.find("div", {'id':'viewercontent1'})
spans = div.find_all('span')
for span in spans:
print span.string
【问题讨论】:
标签: python html web-scraping html-table fasta