技术 SEO

Pagination SEO Auditor

按顺序粘贴分页系列的网址——第 1 页在前——我们会抓取每一页,并检查整个系列是否存在重复 title、canonical 策略混乱、noindex 模式错误、rel="next"/"prev" 链条断裂,以及内容过薄的问题。

最多 12 个网址,仅支持 http(s)。系统会实时抓取每个页面并整体分析整个系列——可能需要几秒钟。

本工具检查的内容

分页系列——分类页第 2、3、4 页、博客归档、论坛帖子、搜索结果列表——最容易在不知不觉中产生重复内容,或把自己的页面藏起来不被搜索引擎收录。逐页检查无法发现这些问题,必须把整个系列放在一起对比,这正是本工具要做的事。

最常见的四类问题

以下每一项都单独评分,再汇总成总分,因为一个系列可能在某一项上出问题,而其他方面都正常。

Canonical 策略

每一页原则上应自我 canonical(当前的通行做法),或者较少见地统一指向第 1 页。如果各页策略互相矛盾,或指向无关网址,我们会标记出来。

Title 与描述重复

如果系列中所有页面共用同一个 <title> 和 meta description,搜索结果就无法区分你的各个页面——这是分页中最典型的错误。

rel="next" / rel="prev" 链条

Google 自 2019 年起已不再使用这两个标签,所以不存在时本工具不会扣分;但如果你添加了它们,我们会核实链条是否真的正确串联第 1→2→3 页,因为断裂的链条比完全没有更糟。

noindex 模式与内容过薄

我们会检查 noindex 指令是否遵循统一、有意为之的模式,并标记出可见文字过少、看起来不像真正有用页面的页面。

常见问题

第 2、3、4……页应该 canonical 到第 1 页,还是自我 canonical?

目前几乎所有分页系列的最佳实践都是自我 canonical,因为每一页通常展示不同的内容项。把所有页面都 canonical 到第 1 页,等于告诉 Google 这些内容项不需要单独收录——只有在你确实提供了包含全部内容的"查看全部"页面时才应刻意这样做。

我还需要 rel="next" 和 rel="prev" 吗?

Google 自 2019 年 3 月起已不再用它们来处理分页,所以对 Google 来说是可选的。部分其他爬虫仍会读取,添加正确的链条无妨——但本工具不会因为没有该链条而报错,只会标记链条错误的情况。

为什么要对第 2、3、4……页设置 noindex?

这是一种合法策略:保持第 1 页可被收录(人们实际搜索和链接的正是它),其余页面设为 noindex,follow,让链接权重仍能在站内流通,而不必让每个内容单薄的列表页互相竞争同一个查询词。只有在应用不一致时才会出问题。

分数是如何计算的?

我们综合权衡五个维度:可访问页面比例(30%)、title 唯一性(25%)、canonical 策略一致性(25%)、meta description 唯一性(10%)以及 noindex 模式(10%)。rel="next"/"prev" 链条断裂会被报告,但不影响分数,因为 Google 并不强制要求它。

我的页面内容会被保存吗?

不会——每个页面仅为生成这一次报告而抓取并在内存中分析,随后即被丢弃。我们不会存储或再次发布抓取到的 HTML。