【发布时间】:2012-08-05 02:31:03
【问题描述】:
我在 Heroku 上有登台和生产应用程序。
对于爬虫,我设置了 robots.txt 文件。
之后我收到了来自 Google 的消息。
尊敬的网站管理员,您网站的主机名,https://www.myapp.com/, 与您的 SSL 证书中的任何“主题名称”都不匹配,它们是:
*.herokuapp.com
herokuapp.com
Google 机器人读取了我的临时应用程序上的 robots.txt 并发送了此消息。因为我没有设置任何东西来阻止爬虫读取文件。
所以,我正在考虑在暂存和生产之间更改 .gitignore 文件,但我不知道该怎么做。
实现这一点的最佳做法是什么?
编辑
我在谷歌上搜索并找到了这篇文章http://goo.gl/2ZHal
这篇文章说要设置基本的 Rack 身份验证,你不需要关心 robots.txt。
我不知道基本身份验证可以阻止 google bot。 似乎这个解决方案比操纵 .gitignore 文件更好。
【问题讨论】:
-
如果 git 是您想要的方式,您可以使用修改后的
.gitignore维护一个stagingbranch,并将该分支推送到 heroku 上的暂存站点. -
嗯,我还是 git 新手,需要了解有关分支的更多信息,请检查该方法。谢谢。
标签: ruby-on-rails heroku gitignore