技术 SEO 解决的是“公开页面能否被访问、理解和维护”,不是排名承诺。页面可被抓取、被索引、在某个查询中出现,分别是不同结果;一次 sitemap 提交或一次构建通过都不能把它们合并成成功。
这里的对象是一条准备公开的产品页、文章页或文档页。先为它确定唯一地址和可复查的发布记录,再讨论工具或插件。
先把页面当作匿名读者会访问的内容
在未登录、无历史 cookie 的浏览器中打开目标 URL,确认返回的状态、标题和核心正文与预期一致。重要文本、链接和必要资源不应只在用户点击或登录之后才出现。
Google 的抓取与索引基础说明指出,预期被抓取的页面及其关键资源需要让爬虫可访问;可用 URL 检查工具查看渲染结果,但不要把某个平台的检查结果当作全体搜索引擎的结论。
发布记录至少包含 URL、页面目的、检查时间和观察到的响应。日后页面没有出现时,这比“我记得它当时没问题”更可用。
为同一内容选一个规范 URL
同一内容常会有尾斜杠、参数、预览域名或大小写不同的多个地址。选择一个公开 URL,并让页面内链、重定向、rel="canonical" 和 sitemap 都指向它。
规范标签表达的是偏好,不是命令。Google 将重定向和 canonical 注解视为较强信号,而 sitemap 中的 URL 是较弱信号;这些信号一致时,搜索系统更容易理解你的选择。具体边界见 Google 的规范 URL 文档。
如果预览环境、筛选参数或旧 slug 仍对外可达,把它们列入发布检查。不要在页面中塞多个相互矛盾的 canonical 来“保险”。
别让 robots、noindex 与 sitemap 互相打架
| 机制 | 用来解决 | 不用来解决 |
|---|---|---|
robots.txt |
管理爬虫请求哪些路径 | 隐藏已经公开的敏感内容 |
noindex |
表达不希望页面进入搜索结果 | 阻止爬虫读取页面上的指令 |
| sitemap | 提供希望被发现的规范 URL | 承诺收录或排名 |
Google 说明 robots.txt 主要用于管理抓取流量;要阻止索引,应使用 noindex、登录保护或移除页面。robots.txt 说明与robots meta 说明都值得在改规则前复查。
sitemap 只放希望公开的完整规范 URL。Google 的sitemap 文档建议使用绝对 URL;本项目由内容集合生成 sitemap,因此应检查构建产物,而非手工复制地址。
发布后按证据排查,而不是反复改标题
一条新页面暂未出现时,按这个顺序复查:
- 匿名访问是否返回预期正文,且没有意外登录跳转;
- 是否带着错误的
noindex、canonical 或重定向; - sitemap 与站内可抓取链接是否指向同一个规范 URL;
- 检查工具看到的内容是否与用户看到的一致;
- 记录时间后等待处理,而不是立刻更换 slug 或制造外链。
标题、描述和正文也应回答同一个问题:读者为什么会来到这里,能带走什么。它们不能替代产品价值,更不该承诺排名、流量或收入。
与发布流程一起复查
URL、metadata 与 sitemap 都是发布的一部分。上线前先检查实际页面和构建产物,再为变更预留观察窗口;具体的停止和恢复记录可参阅《发布与回滚:先设计停止条件,再改生产环境》。性能问题也应从一条真实用户路径开始排查,见《性能优化从一次用户路径开始,而不是从 20 条技巧开始》。
技术 SEO 的价值在于让内容被正确交付。是否值得被选择,仍取决于读者的问题和页面是否真的给出答案。
