技术 SEO
Pagination SEO Auditor
按顺序粘贴分页系列的网址——第 1 页在前——我们会抓取每一页,并检查整个系列是否存在重复 title、canonical 策略混乱、noindex 模式错误、rel="next"/"prev" 链条断裂,以及内容过薄的问题。
最多 12 个网址,仅支持 http(s)。系统会实时抓取每个页面并整体分析整个系列——可能需要几秒钟。
本工具检查的内容
分页系列——分类页第 2、3、4 页、博客归档、论坛帖子、搜索结果列表——最容易在不知不觉中产生重复内容,或把自己的页面藏起来不被搜索引擎收录。逐页检查无法发现这些问题,必须把整个系列放在一起对比,这正是本工具要做的事。
最常见的四类问题
以下每一项都单独评分,再汇总成总分,因为一个系列可能在某一项上出问题,而其他方面都正常。
Canonical 策略
每一页原则上应自我 canonical(当前的通行做法),或者较少见地统一指向第 1 页。如果各页策略互相矛盾,或指向无关网址,我们会标记出来。
Title 与描述重复
如果系列中所有页面共用同一个 <title> 和 meta description,搜索结果就无法区分你的各个页面——这是分页中最典型的错误。
rel="next" / rel="prev" 链条
Google 自 2019 年起已不再使用这两个标签,所以不存在时本工具不会扣分;但如果你添加了它们,我们会核实链条是否真的正确串联第 1→2→3 页,因为断裂的链条比完全没有更糟。
noindex 模式与内容过薄
我们会检查 noindex 指令是否遵循统一、有意为之的模式,并标记出可见文字过少、看起来不像真正有用页面的页面。
常见问题
第 2、3、4……页应该 canonical 到第 1 页,还是自我 canonical?
目前几乎所有分页系列的最佳实践都是自我 canonical,因为每一页通常展示不同的内容项。把所有页面都 canonical 到第 1 页,等于告诉 Google 这些内容项不需要单独收录——只有在你确实提供了包含全部内容的"查看全部"页面时才应刻意这样做。
我还需要 rel="next" 和 rel="prev" 吗?
Google 自 2019 年 3 月起已不再用它们来处理分页,所以对 Google 来说是可选的。部分其他爬虫仍会读取,添加正确的链条无妨——但本工具不会因为没有该链条而报错,只会标记链条错误的情况。
为什么要对第 2、3、4……页设置 noindex?
这是一种合法策略:保持第 1 页可被收录(人们实际搜索和链接的正是它),其余页面设为 noindex,follow,让链接权重仍能在站内流通,而不必让每个内容单薄的列表页互相竞争同一个查询词。只有在应用不一致时才会出问题。
分数是如何计算的?
我们综合权衡五个维度:可访问页面比例(30%)、title 唯一性(25%)、canonical 策略一致性(25%)、meta description 唯一性(10%)以及 noindex 模式(10%)。rel="next"/"prev" 链条断裂会被报告,但不影响分数,因为 Google 并不强制要求它。
我的页面内容会被保存吗?
不会——每个页面仅为生成这一次报告而抓取并在内存中分析,随后即被丢弃。我们不会存储或再次发布抓取到的 HTML。