【发布时间】:2017-10-02 21:34:21
【问题描述】:
我将 robots.txt 文件添加到本地 Web 服务器的根目录。
服务器上robots.txt文件的url是http://localhost/myserver/robots.txt。
robots.txt文件的内容是
User-agent: *
Disallow: /
如何验证 robots.txt 文件是否适用于本地网络服务器?
我需要在本地安装一些网络爬虫或搜索引擎并运行它来验证吗?
谢谢。
【问题讨论】:
-
您在本地运行爬虫?或者这是否适用于某个将在网络上发布的网站,并且您想现在测试 robots.txt(即,一旦网站上线,它是否会按预期工作)?
-
我想在开发环境中进行测试,但还没有在生产环境中进行测试。
标签: web-crawler localhost webserver search-engine