【发布时间】:2016-11-06 03:00:11
【问题描述】:
我对 python 和学习网络爬虫完全陌生。
我正在尝试下载文本页面中的单个目标链接。
到目前为止,我成功提取了我需要的所有目标 URL,但不知道如何下载文本文件中的所有目标 HTML 文本。
谁能给我一个大致的想法。
url = ""
r = requests.get(url)
data = r.text
soup = BeautifulSoup(data, "lxml")
link1 = soup2.find_all('a', href=re.compile("drupal_lists"))
for t in link1:
print(t.attrs['href'])
【问题讨论】:
标签: python beautifulsoup web-crawler