|
|
1
4
特别是在tweets的情况下,谷歌并不是在传统意义上为他们“爬行”;他们已经 integrated with Twitter 实时提供搜索结果。 在更一般的情况下,动态内容对Facebook或Twitter来说并不新鲜,尽管看起来可能是这样。谷歌搜索一个URL;该URL提供HTML数据;谷歌对其进行索引。无论是呈现页面的动态查询,还是静态HTML的缓存,对索引过程都没有什么影响。 理论上。 在实践中,还有很多东西(见下面迈克尔B的评论)。 看看Vartec的简明扼要的帖子,关于谷歌如何在不登录和浏览FB的情况下找到所有的Facebook公开档案。 好吧,这过于简单化了,但让我们看看人们还有什么要说的…… |
|
|
2
1
据我所知,谷歌无法读取和存储个人资料的实际内容,因为谷歌机器人没有Facebook帐户,这将是一个巨大的隐私漏洞。 这个机器人通过点击facebook.com,然后跟踪它能找到的每个链接来工作。无论它在点击的页面上看到什么内容,它都会存储。所以,即使它遵循一个动态的URL,比如www.facebook.com/username,它也只会记住它在访问时看到的一切。希望在这种特殊情况下, 不是 所述用户的所有私有数据。 此外,Facebook可以并且确实提供搜索机器人可以遵循的特殊指令,这样谷歌的结果就不会包含大量的登录页面。 |
|
|
3
1
|