【发布时间】:2023-04-10 05:05:01
【问题描述】:
有很多网络抓取引擎,即在 python 中,但它们只关注内容。有没有办法抓取页面的文本内容以及应用于文本的计算样式,例如font-face、font-size、line-height、color、background 等?
【问题讨论】:
-
仅内容是什么意思?网络爬虫使用 xpath、css 和 html 解析器的组合来与 DOM 交互。
标签: python web-scraping