面向网站所有者的规范链接标签检查器
首页
规范链接标签检查器
规范链接标签检查器:同时检查规范链接、重定向和 Noindex | We.Inc
粘贴网页 HTML 和响应标头,核对规范链接标签、目标网址、HTTP 状态、重定向及 noindex 指令。查看冲突信号,并导出修正清单。
输入页面地址和您希望搜索引擎收录的地址,然后粘贴网页 HTML 源代码;如果有响应标头,也可以一并粘贴。检查器会读取规范链接标签、HTTP 规范链接标头、robots 元标签和 X-Robots-Tag、状态代码及重定向链,并指出它们之间的冲突。它不会访问其他网站:浏览器会阻止一个网站读取另一个网站的内容,我们也不会运行隐藏爬虫。您粘贴工具所需的内容后,它只会检查这些文本。页面会显示获取标头和 HTML 的单行命令。
输入您检查的网址,以及您希望编入索引的首选网址(通常二者相同)。 在终端运行 curl -sIL,后接网址,以获取标头并粘贴输出。结果会显示每次重定向以及最终状态代码。 在浏览器中选择“查看源代码”(Ctrl+U 或 Cmd+Option+U)获取 HTML,或运行 curl -sL 后接网址,然后粘贴内容。 检查器会查找 HTML 和 Link 标头中的所有 rel=canonical、robots 元标签、X-Robots-Tag,以及每次跳转的状态。 每项结果都会说明这是错误、需要检查还是正常,并解释原因。缺少输入时会显示“未检查”,不会误报为通过。 下载文本格式的修正清单,交给负责修改网站的人。
规范链接应指向返回 200 状态、没有重定向、未设置 noindex 且内容相同的页面。 每页使用一个规范链接。两个不同的规范链接,或标签与标头不一致,都会让搜索引擎忽略两者。 使用以 https 开头的绝对网址,并统一选择 www 或非 www 主机名。 不要同时设置 noindex 并将规范链接指向其他页面:一个指令要求移除此页,另一个要求合并页面;请选择其一。 规范链接只是提示,并非命令。对于同一页面选择,重定向和一致的内部链接信号更强。
常见问题
为什么需要粘贴 HTML?
浏览器会阻止网页读取其他网站的内容,因此在浏览器中运行的工具无法替您抓取页面。看起来能自动抓取的网站通常会通过服务器代为访问。我们选择让这个工具完全在您的浏览器中运行,并清楚说明如何获取源代码。
规范链接标签有什么作用?
当同一内容可通过多个地址访问时(例如网址带有或不带跟踪参数),规范链接会告诉搜索引擎哪个地址是页面的主要版本。搜索引擎通常会遵循它;如果其他信号冲突,也可能选择另一个网址。
每个页面都应该设置指向自身的规范链接吗?
这是一个不错的默认做法。指向页面自身的规范链接可以防范参数、大小写或尾部斜杠造成的重复页面。
缺少规范链接和抓取受阻有什么区别?
在这里,缺少规范链接表示您粘贴的 HTML 中没有 rel=canonical。如果您没有粘贴内容,或粘贴的是错误页面,检查器会说明 HTML 尚未检查,避免您把抓取失败误认为缺少标签。
Google 总会采用我设置的规范链接吗?
不会。Google 将其视为强提示。Search Console 中的“网址检查”工具会显示 Google 实际选择的规范网址。
信号冲突
大多数规范链接问题都是指令相互矛盾:规范链接指向了重定向页面;页面设置了 noindex,却又将规范链接指向其他页面;HTML 中的标签与 HTTP 标头中的标签不同;或者 HTTPS 网站上的规范链接却指向 HTTP。这些情况同时向搜索引擎传递相互冲突的信号,最终由搜索引擎自行选择。 同时检查规范链接、状态代码、重定向和 robots 指令,才能发现这些矛盾。只读取标签的检查器会漏掉大多数问题。
实际示例
打开页面上的示例:一个虚构的 example.com 服务页面,先从 http 重定向到 https,但其规范链接指向 www 主机上的 http 地址并带有尾部斜杠。检查器会报告重定向、指向 http 的规范链接、不同主机名上的规范链接,以及与首选网址不匹配的问题,并分别给出修正方法。
免费开始 · 无需信用卡
Product
Who It's For
Features
Resources
Company
View Sitemap