【发布时间】:2014-06-15 07:23:45
【问题描述】:
我正在使用服务器端 node.js 函数来获取浏览器传递的 URL 的文本,以便在书签服务中自动索引该 URL。我使用jsdom 进行服务器端渲染。但是,尽管请求来自合法用户,但我还是被热门网站屏蔽了。
有没有办法在浏览器端实现 URL 文本提取,这样请求似乎总是来自正常分布的用户?如何绕过浏览器中的跨站点安全限制?我只需要最终的 DOM 渲染文本。
书签是最好的解决方案吗?当用户想要为页面添加书签时,我只需在书签中附加一个表单并在我的书签中提交 DOM 呈现的文本?
我知道 SO 讨厌辩论,但非常感谢任何关于好的方法的指导。
【问题讨论】:
-
只是为了澄清。您希望用户向您的服务提交 URL,以将目标页面的渲染副本抓取到数据库中?如果是这样,为什么不仅只获取一次页面,下一个请求它的人会触发更新,而是添加一些服务器代码以确保调用之间必须有最短的经过时间?
-
页面可能不同,但在同一个域中,例如维基百科文章或亚马逊产品。
标签: javascript dom cross-domain