技术 SEO

Title 与 Meta Description 重复检测器

粘贴导出的页面列表——URL、title、meta description,每行一个页面——一次性审查所有页面的重复标签、缺失标签和搜索结果截断风险。

支持 Tab、竖线(|)或逗号分隔的行(表格粘贴或 CSV 导出可直接使用)。单次最多 300 行;description 列可留空。

本工具检测什么

在大型网站上,重复或缺失的 title 标签是最常见的技术 SEO 问题之一——通常源自模板、分页或分面导航,而非单一失误。本工具一次性审查整份导出的页面列表:哪些 title 和 description 是完全重复或近似重复的模板变体、哪些缺失、哪些长度足以在 Google 结果中被截断——这类站点级模式几乎不可能靠逐页打开来发现。

检测原理

每一行先单独检测长度与截断风险,再与其余所有行比对以发现重复。

完全重复与近似重复检测

title 和 description 会以标准化文本进行完全重复比对,并以词集合(Jaccard/包含度重叠——与我们的 Duplicate Content Checker 使用的同一类技术)进行近似重复比对,从而捕捉只替换了一个词或数字的模板化 title。

SERP 像素宽度截断

仅靠字符数并不可靠——一个全是窄字母(i、l、t)的 title 能放得下,而同样长度、全是宽字母(m、w、M)的 title 却已被截断。本工具使用标准 Arial 字形度量,对照 Google 桌面端大致的截断点(title 约 580px,description 约 920px)估算实际渲染像素宽度。

缺失标签检测

title 或 description 为空的行会与重复和长度问题分开单独标记,因为空标签意味着由 Google 替你决定文案。

重复 URL 检测

同一个 URL 出现在两行通常意味着数据录入或导出错误——会被标记出来,以便你在处理结果前先修正源列表。

常见问题

应该粘贴什么格式?

每行一个页面,字段以 Tab、竖线(|)或逗号分隔。最简单的来源是表格软件粘贴(自动使用 Tab)或来自 Screaming Frog 等爬虫工具的 CSV 导出——复制 URL、Title 和 Meta Description 三列即可。表头行会被自动识别并跳过。

如果页面内容不同,重复 title 为什么算问题?

搜索引擎用 title 标签理解页面主题,也帮助用户在结果中做选择。当许多页面共用同一 title 时,意味着这些页面区分度不够,Google 也可能干脆替其中一些页面另选 title——这会破坏你真正想展示的文案。

近似重复的 title 一定要修改吗?

不一定——某些模板化的 title 模式(例如「[城市]天气预报」)本就是刻意为之,只要每个实体名称确实不同就没问题。把近似重复标记当作一个提醒,去检查变化的部分是否真实存在且有意义,而不是自动判定为错误。

这个工具会抓取我的页面或把数据发送到别处吗?

不会抓取任何页面。粘贴的列表只会通过 HTTPS 发送一次到我们的服务器执行比对(这样匹配逻辑才能保持服务器端一致),处理完不会保留。