SEO · 发布 · 内容 · 独立开发

技术 SEO 发布:先确认一条页面能被理解和维护

围绕规范 URL、可抓取内容与发布后的观察路径检查新页面;不把 sitemap、提交或性能分数当成排名承诺。

技术 SEO 解决的是“公开页面能否被访问、理解和维护”,不是排名承诺。页面可被抓取、被索引、在某个查询中出现,分别是不同结果;一次 sitemap 提交或一次构建通过都不能把它们合并成成功。

这里的对象是一条准备公开的产品页、文章页或文档页。先为它确定唯一地址和可复查的发布记录,再讨论工具或插件。

先把页面当作匿名读者会访问的内容

在未登录、无历史 cookie 的浏览器中打开目标 URL,确认返回的状态、标题和核心正文与预期一致。重要文本、链接和必要资源不应只在用户点击或登录之后才出现。

Google 的抓取与索引基础说明指出,预期被抓取的页面及其关键资源需要让爬虫可访问;可用 URL 检查工具查看渲染结果,但不要把某个平台的检查结果当作全体搜索引擎的结论。

发布记录至少包含 URL、页面目的、检查时间和观察到的响应。日后页面没有出现时,这比“我记得它当时没问题”更可用。

为同一内容选一个规范 URL

同一内容常会有尾斜杠、参数、预览域名或大小写不同的多个地址。选择一个公开 URL,并让页面内链、重定向、rel="canonical" 和 sitemap 都指向它。

规范标签表达的是偏好,不是命令。Google 将重定向和 canonical 注解视为较强信号,而 sitemap 中的 URL 是较弱信号;这些信号一致时,搜索系统更容易理解你的选择。具体边界见 Google 的规范 URL 文档。

如果预览环境、筛选参数或旧 slug 仍对外可达,把它们列入发布检查。不要在页面中塞多个相互矛盾的 canonical 来“保险”。

别让 robots、noindex 与 sitemap 互相打架

机制 用来解决 不用来解决
robots.txt 管理爬虫请求哪些路径 隐藏已经公开的敏感内容
noindex 表达不希望页面进入搜索结果 阻止爬虫读取页面上的指令
sitemap 提供希望被发现的规范 URL 承诺收录或排名

Google 说明 robots.txt 主要用于管理抓取流量;要阻止索引,应使用 noindex、登录保护或移除页面。robots.txt 说明与robots meta 说明都值得在改规则前复查。

sitemap 只放希望公开的完整规范 URL。Google 的sitemap 文档建议使用绝对 URL;本项目由内容集合生成 sitemap,因此应检查构建产物,而非手工复制地址。

发布后按证据排查,而不是反复改标题

一条新页面暂未出现时,按这个顺序复查:

  1. 匿名访问是否返回预期正文,且没有意外登录跳转;
  2. 是否带着错误的 noindex、canonical 或重定向;
  3. sitemap 与站内可抓取链接是否指向同一个规范 URL;
  4. 检查工具看到的内容是否与用户看到的一致;
  5. 记录时间后等待处理,而不是立刻更换 slug 或制造外链。

标题、描述和正文也应回答同一个问题:读者为什么会来到这里,能带走什么。它们不能替代产品价值,更不该承诺排名、流量或收入。

与发布流程一起复查

URL、metadata 与 sitemap 都是发布的一部分。上线前先检查实际页面和构建产物,再为变更预留观察窗口;具体的停止和恢复记录可参阅《发布与回滚:先设计停止条件,再改生产环境》。性能问题也应从一条真实用户路径开始排查,见《性能优化从一次用户路径开始,而不是从 20 条技巧开始》。

技术 SEO 的价值在于让内容被正确交付。是否值得被选择,仍取决于读者的问题和页面是否真的给出答案。

延伸阅读