【问题标题】:Crawling and validating JavaScript code in a web document抓取和验证 Web 文档中的 JavaScript 代码
【发布时间】:2018-11-09 02:46:40
【问题描述】:

我正在开展一个项目,我需要在网页上执行“不得篡改分析代码”政策。是否有可能执行这样的政策?我认为它应该通过以下方式可行:

  1. 抓取网页。
  2. 检查上述 JavaScript 代码所在的位置 居住。
  3. 检查代码是否与预期的相同。

这样合理吗?有人有什么办法可以绕过这项政策吗? (我不关心篡改代码的能力,只要我能检测到代码已被篡改即可。

【问题讨论】:

    标签: javascript web-crawler analytics


    【解决方案1】:

    我很好奇这项政策背后的动机。确保客户端javascript不被篡改的目标到底是什么?如果您的目的是提供可以部署在用户应用程序中的小部件,那么爬取客户端页面以检查 javascript 绝对是可行的。通过插入未在所有正确位置执行的虚拟代码可能会欺骗您的爬虫。似乎是一个奇怪的要求。对不起,如果这没有帮助。

    【讨论】:

    • 谢谢。它本身并不是真正的“客户”。我想出了一个考虑跳出率的排名机制。因此,要使其正常工作,跳出率不应被篡改。
    猜你喜欢
    • 1970-01-01
    • 2011-01-05
    • 1970-01-01
    • 2011-12-09
    • 2015-08-10
    • 2012-05-28
    • 2013-01-14
    • 2011-04-17
    • 2014-08-19
    相关资源
    最近更新 更多