61% 的站点留下重要页面,带有 0 内部链接
我们的爬虫为每个审核站点构建链接图。在 30 的 49 上,站点自身声明重要的页面拥有 0 内链——被其自身站点 孤立。
我们运行的每次审核都会构建站点内部链接的有向图:我们捕获的每个页面、它携带的每个锚点、它们之间的每条边。 从五月 5 到 August 15, 2026,该图在我们审核的 49 站点的 30 上讲述了同样的故事——至少 1 个站点自身声明重要的页面在样本中任何地方都有 0 个内部入链。 这就是 61% 的站点发布页面,在 sitemap 中列出,然后从任何地方都不链接到它。
发现更难,因为所有者把注意力放在哪里。 反向链接获得预算、外联活动和焦虑,但反向链接是另一站点可能给你也可能不给你的东西。 内部链接是你完全控制的唯一排名输入——图中的每条边都是 HTML 的一行,你今天可以写下——在我们的数据中,它们是大多数站点悄悄失败的输入。
你的 sitemap 是一份承诺清单,链接图检查你是否兑现它们
这里的“重要”来自站点自身的声明,而非猜测:主页加上其 sitemap 列出的页面。 sitemap 是向搜索引擎的第一方声明:这些是我想让你索引的 URL. 以站点的字面意思为准,就会对每个除主页外声明的页面留下一个机械问题:是否有其他页面链接到它?
回答这个问题意味着把站点当作一张图,其中每个内部锚点都是一条有向边——页面 A 链接到页面 B。从这些边可以得出每页的 2 个数字:有多少页面链接到它,以及它距离主页有多少次点击。 本文讨论的发现是最直白的版本:一个声明的页面拥有 0 个入链。 它在 sitemap 中,但站点其余部分表现得好像它不存在。
数据集
| 重要页面链接充分 | 1+ sitemap-声明页面有 0 发现的入链 | 30 of 49 (61.2%) |
| 内部链接图已构建 | 在所有捕获页面中发现 0 内部链接边 | 3 of 49 (6.1%) |
方法论:每个域名的最新完成审计快照来自我们当前的检查集,5月 5 – August 15, 2026,匿名化 — 49 审计站点,按检查的分母在 46 与 49 之间变化,因为并非每个检查都在每个站点上运行。 样本为自选 — 运行审计的所有者 — 并倾向于中小型。 入链计数是在每次审计所捕获的页面内测量的,因此它们描述的是每个站点可发现的核心,而非其所有页面。
图表底部的 3 个站点失败了更基本的问题:在捕获了多个 HTML 页面后,爬虫无法在任何地方发现单个内部链接边。 这就是当站点的导航仅存在于 JavaScript 中,爬虫从未执行,或每个页面都是自包含岛屿时的样子。 对于这些站点,缺链问题无关紧要 — 整个架构是不可见的。
发布创建页面和 sitemap 条目,且没有任何东西创建链接
61% 速率在追踪页面如何存在后才有意义。 CMS 创建 URL,渲染模板,并自动将条目追加到 sitemap。 出版的每一步都是自动化的,除了对发现重要的 1:从已存在的页面链接到新页面。 为活动构建的登录页面,发布后添加的服务页面,来自电子表格生成的地点页面——每个都是1孤立模板,远离隐形,完全发布且完全未被引用。
这一模式远远超出了我们的样本。 一份由 Digital Applied 所做的 2026 review of large-site architecture by Digital Applied 把大约 25% 的网页置于 0 条内部链接 — 他们自己将此数字标记为示意性而非精确性。 我们的每站费用高于每页费用,原因很简单:一个站点只需要1一个孤立的重要页面就会失败,而大多数站点至少有1.
孤立页面失去的是具体的。 爬虫晚到并很少重新抓取,因为链接路径决定了抓取优先级。 它没有获得流经站点的权威份额,因为权威沿着边缘移动。 它在没有上下文的情况下排名,因为内部锚文本是站点其余部分描述页面内容的方式。 网站地图条目获取页面;链接让它被理解。 用于构建答案的 AI 爬虫遵循相同的边缘,因此同一页面也会在该表面缺失。
解决方案是列表、计数和3链接模式
先从列表开始。 列出能为你带来收益的页面:转化页面、服务和产品页面、用户来完成的顶级任务页面。 你的站点地图是超集;此列表是你会因发现孤立而感到尴尬的子集。 对于大多数小型和中型站点,它是10–30 URL.
为每个页面计数内部链接。 Google Search Console 的 Links 报告显示每页的内部链接计数;任何桌面爬虫都会给你一个内部链接列。 付费的 SEOReport 诊断 会列出每个声明页面及其发现的内部链接计数和点击深度,因此孤立页面被命名而非怀疑。 每个重要页面应至少拥有来自3其他页面的链接,且可在3 次点击内从主页访问。
然后使用可扩展的模式添加链接:
- 上下文正文链接 是最高价值的边缘:相关文章或服务页面中的一句话,用描述性锚文本链接——“奥斯汀的商业屋顶检查”,而不是“点击此处”。 这些携带主题上下文,导航链接无法提供。
- 中心页面 按主题分组相关页面并链接到每个页面,而每个子页面又回链到上层。 1 中心覆盖8 孤立服务页面,使用 1 模板修复 8 发现。
- 相关文章和产品模板上的相关内容模块 在你发布时自动创建边缘。 这是解决“没有人创建链接”缺口的结构性修复——新页面因为模板链接而被链接。
- 导航 用于少数顶级任务。 全站导航为页面提供全站存在感,并迅速稀释:一个 90 链接 mega-menu 为每个目的地提供一丝重量,却未向搜索引擎透露任何关于它们的具体信息。
直接链接到规范 URL,简单明了。 边缘应指向 /products/blue-widget,绝不指向 /products?color=blue&sort=price 或其过滤变体。 参数化目标会将您的权威分散到重复 URL 上,并放大爬取浪费;而指向同一页面众多参数化变体的内部链接,本身就是一个爬取问题。 同样的纪律适用于内部链接上的跟踪参数:去除它们。
在购买另一条反向链接前先检查图谱
内部架构失败是安静的。 我们的 most-failed checks ranking 主要由缺失 HTTP 头部主导——配置无人看到。 低链接页面是同一现象的内容层版本:没有任何渲染差异,CMS 不会警告您,页面甚至在站点地图报告中显示为存在并已索引。 该失败只有在某物机械枚举图谱时才可见,这正是审核所做的,而人类永远不会做。 该枚举应包含在任何 systematic audit pass 中,和爬取与可索引性检查并列。
我们样本中通过审核的网站并非拥有最大链接预算的网站。 它们是每个重要页面都有路径指向的站点——上方有枢纽,旁边有模块,描述它的锚点。 您可以控制这些边缘中的每一个。 这在 SEO 中很罕见,值得在再花一美元购买您必须请求的链接之前采取行动。