【发布时间】:2013-07-08 11:48:59
【问题描述】:
当用户在界面中输入书名并显示所有信息时,我需要开发一个网络应用程序,用于从不同的电子商务网站(如 amazon、homeshop18)中提取图书价格。
我的问题是 1)如何将该查询传递给亚马逊网站搜索框,我只能获取与查询相关的页面,而不是抓取整个网站。
2) 可以使用什么来开发此应用程序?BeautifulSoup 还是 scrappy?API 并非所有电子商务网站都可以使用它
我是 python 新手。所以任何帮助都将受到高度赞赏
【问题讨论】:
-
需要更多信息。您要抓取哪个网站?你试过什么?
-
任何书籍购物网站。我使用 urllib 模块来获取 html 页面源,不知道如何进一步生成
-
您可能需要考虑将 BeautifulSoup 用于您的目的。它有助于解析 HTML
-
为什么要重新发明轮子?已经有一些工具可以做到这一点,比如agenty.com
标签: python python-2.7 e-commerce web-scraping