【发布时间】:2013-11-07 13:35:49
【问题描述】:
我正在使用 robots.txt 从蜘蛛中排除一些页面。
User-agent: *
Disallow: /track.php
当我搜索引用到此页面的内容时,谷歌说:“由于此站点的 robots.txt,因此无法获得此结果的描述 - 了解更多信息。”
这意味着 robots.txt 正在运行.. 但是为什么蜘蛛仍然找到该页面的链接?我想没有指向“track.php”页面的链接......我应该如何设置 robots.txt? (或类似 .htaccess 之类的东西..?)
【问题讨论】:
-
如果您访问
domain.com/robots.txt,您会看到您的 robots.txt 还是 404 页面? -
我看到了 robots.txt!
标签: .htaccess robots.txt web-crawler