代码之家  ›  专栏  ›  技术社区  ›  Gumbo

搜索引擎是否尊重HTTP头字段内容位置?

  •  13
  • Gumbo  · 技术社区  · 17 年前

    我想知道搜索引擎是否尊重 HTTP header field Content-Location

    例如,当您希望从URL中删除会话ID参数时,这可能很有用:

    GET /foo/bar?sid=0123456789 HTTP/1.1
    Host: example.com
    …
    
    HTTP/1.1 200 OK
    Content-Location: http://example.com/foo/bar
    …
    

    澄清:

    也许我的例子不能很好地表达我问题的意图。所以请看一看 What is the purpose of the HTTP header field “Content-Location”? .

    5 回复  |  直到 9 年前
        1
  •  7
  •   Gumbo    17 年前

    我想谷歌刚刚宣布了我问题的答案: the canonical link relation for declaring the canonical URL .

    Maile Ohye 谷歌写道:

    米奇说。。。
    您应该使用内容位置标题,如下所示:
    http://www.w3.org/Protocols/rfc2616/rfc2616-sec14.html
    “14.14内容位置”

    1. 我们的数据显示,“内容位置”标题在许多网站上配置不当。有时网站管理员提供的长而难看的URL甚至不重复——这可能是无意的。他们可能不知道他们的Web服务器甚至正在发送内容位置头。

      联系网站所有者以解决整个web中的内容位置问题会非常耗时。我们意识到,如果我们从头开始,我们可以更快地提供功能。微软和雅虎!为了支持这种格式,网站管理员只需要学习一种语法。

    2. 网站管理员通常很难配置他们的web服务器头,但可以更轻松地更改他们的HTML。rel=“canonical”似乎是一个友好的属性。

    http://googlewebmastercentral.blogspot.com/2009/02/specify-your-canonical.html?showComment=1234714860000#c8376597054104610625

        2
  •  1
  •   Vinko Vrsalovic    17 年前

    大多数体面的爬虫确实遵循内容位置。因此,是的,搜索引擎尊重内容位置标题,尽管这不能保证具有sid参数的URL不会出现在结果页面上。

        3
  •  0
  •   Philzen    12 年前

    2009年,谷歌开始将URI视为合格的 rel=canonical 在响应体中。

    看起来自2011年以来,按照RFC5988格式化的链接 also parsed from the header field Link: . 报告中也明确提到了这一点 Webmaster Tools FAQ

    我猜这是为搜索引擎提供一些额外的超媒体面包屑的最新方式——这样,当你实际上不需要将它们作为内容提供时,就可以让它们不出现在响应体中。

        4
  •  -2
  •   Einstein    17 年前

    除了使用“位置”而不是“内容位置”之外,根据重定向的原因,在响应中使用正确的HTTP状态代码。搜索引擎倾向于使用永久重定向(301)状态而不是临时重定向(302)状态。

        5
  •  -4
  •   JDrago    17 年前

    试试“位置:”标题。

    推荐文章