Semrush 在 2026 年 6 月 23 日更新了它的技术 SEO 清单,作者 Tushar Pol,页面标注约 15 分钟阅读。和 2025 年 7 月 31 日的旧版相比,最明显的变化写在标题里:这份清单现在同时面向搜索引擎和 AI 搜索,正文里多出了 AI grounding 与 agent readiness 两块内容。
对做站的人来说,值得先弄清的不是新增了哪几个勾选项,而是这些项目里哪些有官方机制兜底,哪些只是「可能有帮助」。这两类混在同一个清单里,很容易被读成同一强度的要求。
Semrush 这版清单按抓取与索引、用户体验、网站结构、代码与配置、AI grounding 与 agent readiness 分块,具体条目包括索引状态、重复站点版本、robots.txt、重定向、断链、5xx、移动体验、Core Web Vitals、内链、面包屑、孤立页面、HTTPS、hreflang、结构化数据、AI 抓取访问和语义 HTML。Core Web Vitals 的良好阈值它给的是 LCP 2.5 秒以内、INP 200 毫秒以内、CLS 低于 0.1,检查工具建议用 Search Console 和 PageSpeed Insights。
前面几块基本能在 Google 的抓取与索引文档里找到对应机制:robots.txt 管的是抓取请求,noindex 管的是索引,sitemap 的作用是告知 Google 有新增或更新页面,canonical 用来声明重复或相似页面的首选版本。这里有个容易搞错的强弱差别,Google 关于合并重复网址的说明把重定向和 rel=canonical 算作强信号,把「收进 sitemap」只算较弱信号,而且 Google 保留自己另选 canonical 的权利。也就是说,靠 sitemap 表达偏好和靠 301 表达偏好,不是一个量级的动作。
新增的 AI 部分需要更谨慎地读。Google 的生成式 AI 搜索指南的表述是:传统 SEO 最佳实践仍然是 Google AI 功能的基础,页面要能被抓取、被索引、并且有资格显示摘要;但同一份文档紧接着写明,满足这些要求并不保证被抓取、索引或展示。更直接的一条是,Google 说生成式 AI 搜索不要求特殊 schema,也不要求完美的语义 HTML。结构化数据依然对普通搜索的富媒体结果有用,语义 HTML 对可读性和辅助技术有价值,但把它们写成「AI 可见性的门槛」,超出了官方给出的口径。Semrush 提到 schema 可能帮助 AI 提取信息,按 Google 的说法,这只能停在可能性上。
还有一处不该被清单简化的地方:不同 AI 服务的检索抓取器、训练抓取器和用户触发的代理并不是同一类系统。它们对 robots.txt 的支持程度和实际执行行为需要按各服务的官方文档逐一核对,无法从一条通用建议推出来。
从业者的分歧不在清单本身,在它被怎么用
r/TechSEO 最近的一场讨论主题是「你不再推荐的技术 SEO 建议」,反复出现的质疑正是通用清单容易让人把 sitemap、页面速度这类项目当成排名保证;参与者更在意 canonical 选择、渲染差异、索引资格,以及具体站点的具体故障。r/SEO 上另一场关于 LLM SEO 的讨论,结论接近:索引、可抓取性、内链和页面速度确实是传统搜索和 AI 搜索的共同基础,但不少打着 AI SEO 名义的服务,本质是给旧清单换个标签。
一个具体案例更能说明清单该往哪儿用。有用户在 r/TechSEO 报告,他们的 SaaS 首页在浏览器里显示正常,但不执行 JavaScript 的 AI 抓取器只能读到很少文本。这是原始 HTML 与渲染结果不一致的典型排查题,值得照着查一遍;但它是单个站点的报告,不能推广成所有 AI 抓取器都不执行 JavaScript。社交平台的帖子只代表原帖和读者讨论,事实仍要回到官方文档和自己站点的数据。
所以这份清单更接近一个诊断顺序:先确认页面能被抓取和索引,再看体验和结构,最后处理原始 HTML 是否包含实质内容这类新问题。它不是完成即达标的承诺书,Google 自己已经把这句话写进文档。
各自还得去查的是,你在意的那几个 AI 抓取器分别怎么声明自己的抓取规则和渲染能力。这部分没有统一答案,清单也给不了。

TopsTip