【问题标题】:How do search engines see dynamic profiles?搜索引擎如何查看动态配置文件?
【发布时间】:2012-09-28 14:02:13
【问题描述】:

最近,搜索引擎已经能够对社交网站上的动态内容进行分页。我想了解这是如何完成的。是否有像 Facebook 这样的网站创建的、半频繁更新的静态页面。 Google 是否会尝试存储所有可能的用户名?

据我了解,像 www.facebook.com/username 这样的页面并不是存储在磁盘上的实际文件,而是以下查询的简写:从用户中选择用户名并在页面上显示信息。谷歌如何了解每个用户,当涉及到诸如推文之类的事情时,这变得更加复杂。

编辑:我想我并没有真正问我想知道什么。我是否需要像 twitter 或 facebook 一样大,以便 google 以特殊方式抓取我的网站?如果我允许任何人查看我的用户个人资料,谷歌会自动找到它们吗?如果不是,我该怎么做才能让它发挥作用?

【问题讨论】:

    标签: search-engine


    【解决方案1】:

    特别是对于推文,Google 并不是传统意义上的“抓取”它们;他们integrated with Twitter 可以实时提供搜索结果。

    在您的问题的更一般情况下,动态内容对于 Facebook 或 Twitter 来说并不新鲜,尽管它可能看起来是。谷歌抓取一个网址; URL 提供 HTML 数据;谷歌索引它。无论是呈现页面的动态查询,还是静态 HTML 的缓存,在理论上对索引过程几乎没有影响。在实践中,它还有很多其他功能(请参阅 Michael B 的评论下面。)

    并查看 Vartec 的简洁帖子,了解 Google 如何在不实际登录和浏览 FB 的情况下找到所有这些公开的 Facebook 个人资料。

    好吧,这太简单了,但让我们看看人们还有什么要说的......

    【讨论】:

    • 实际上,Google 确实非常关心页面是否是动态构建的,否则爬虫很容易陷入组合爆炸或无限量的动态生成的垃圾邮件内容中.
    • 那么,如果我有一个包含用户个人资料的网站,那么我不需要做任何事情来让谷歌抓取我的用户个人资料?
    • 您可以向 Google 提交站点地图 [google.com/support/webmasters/bin/… 让他们知道要抓取您的 www.mysite/users 目录。您还可以依赖“传统”的 Google 方法:鼓励外部页面链接回您的用户个人资料页面。
    【解决方案2】:

    据我所知,Google 无法读取和存储个人资料的实际内容,因为 Google bot 没有 Facebook 帐户,这将是一个巨大的隐私泄露。

    该机器人通过点击 facebook.com,然后点击它可以找到的每个链接来工作。无论它在点击的页面上看到什么内容,它都会存储。因此,即使它遵循像 www.facebook.com/username 这样的动态 url,它也会记住它去那里时看到的任何内容。希望在这种特殊情况下,它不是所述用户的所有私人数据。

    此外,Facebook 可以并且确实提供了搜索机器人可以遵循的特殊说明,因此 google 搜索结果不会包含大量登录页面。

    【讨论】:

    • 但如果访问 facebook.com,它会看到注册和登录等链接。主页上没有用户配置文件。因此,如果我有一个谷歌不知道有用户个人资料的网站,我如何让谷歌知道我的用户在 mysite.com/username?
    【解决方案3】:
    1. 个人资料可以从外部链接;
    2. 网站可能会提供站点地图

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2011-10-10
      • 1970-01-01
      • 1970-01-01
      • 2015-02-04
      • 1970-01-01
      • 1970-01-01
      • 2016-06-09
      相关资源
      最近更新 更多