本网站为 Codex AI 建站作品展示,欢迎交流

SEO小平

技术 SEO 审计完整指南:15 个检查维度与实操步骤

系统讲解如何做一次完整的技术 SEO 审计:索引与可抓取性、SSL/HTTPS、重复 URL、网站安全、重定向与失效链接、Core Web Vitals、元数据与标题、Schema 结构化数据、XML 站点地图、分页、内容质量、内链、E-E-A-T 信任信号、本地 SEO,以及如何输出可执行的优先级审计报告。

技术SEOSEO审计GSCScreaming FrogCore Web Vitals结构化数据HTTPS
技术 SEO 审计完整指南:15 个检查维度与实操步骤

一次技术 SEO 审计,能识别出阻碍网站排名的结构性问题、可抓取性问题和内容问题。做对了,它能给你一份排好优先级的修复清单,每一项都能真正推动排名;做砸了,它只会产出一份没人会去执行的表格。

本指南覆盖技术审计的每一个层面:从抓取配置和 HTTPS 验证,到页面元数据和 Schema 校验。每个部分都会说明检查什么、为什么重要、以及由谁负责修复。

一场技术审计由两个角色共同驱动:SEO 专员或文案负责索引信号、内容质量、元数据和结构化数据;开发者负责服务器级配置、重定向、HTTPS 和性能。两个角色共同对最终的审计报告负责。

技术 SEO 审计的起点

1. 索引与可抓取性:每场技术 SEO 审计的起点

可抓取性(Crawlability)决定 Googlebot 能否触达你的页面;可索引性(Indexability)决定它是否选择收录这些页面。任何一层的问題,都会压制排名,与内容质量无关。

Google 索引检查

从 Google Search Console(GSC)开始。打开”覆盖面”(Coverage)报告,检查是否存在”已抓取 - 尚未编入索引”或”已发现 - 尚未编入索引”状态的页面。这两种状态都说明 Googlebot 找到了 URL,但决定不收录它。原因几乎总是质量信号、抓取预算问题或配置指令错误。

通过搜索 cache:yourdomain.com 验证首页是否出现在 Google 缓存中。缓存条目过期或缺失,说明 Google 最近没有抓取该页面,这是抓取频率的危险信号。

再做一次品牌词搜索。如果首页在自有品牌名的搜索中排不到第一位,可能存在更深层的可索引性问题或信任问题,值得深入排查。

可索引性信号

打开 yourdomain.com/robots.txt 文件。这个文件告诉搜索引擎爬虫可以访问哪些页面或目录。检查是否有 Disallow 指令屏蔽了重要页面。一个常见错误是错误地屏蔽了 /wp-admin/,结果意外挡掉了 Googlebot 渲染页面所需的 CSS 或 JS 目录。

检查每个重要页面 head 部分的 noindex 标签。noindex 标签是告诉 Google 不要把页面收录进搜索结果的指令。一个放错位置的 noindex,可能悄悄让整个分类枢纽页下面的数百个页面从索引中消失。Screaming Frog 可以在”指令”(Directives)标签页下规模化标记这些问题。

检查重要页面上的 nofollow 标签。nofollow 属性告诉 Google 不要通过该链接传递排名信用。内链上的 nofollow 会减少流向目标页面的 PageRank(Google 用来判断页面权威度的信号)。在导航链接或核心内容上使用 nofollow 很少是合适的。

X-Robots-Tag 响应头与 meta robots 标签作用相同,但它工作在 HTTP 响应层面而不是页面 HTML 中。它更难被发现,可能屏蔽整个目录。用 curl 请求检查:curl -I https://yourdomain.com/page-url/

Google Search Console 配置

GSC 是任何技术 SEO 审计的主要数据来源。它提供 Google 关于爬虫如何查看和索引网站的直连数据。每周检查一次”索引”(Indexing)报告,而不是只在审计时才看。如果网站只服务单一市场,在”旧版工具”(Legacy Tools)下配置地理定位。

在”站点地图”(Sitemaps)下提交 XML 站点地图,监控其索引率。站点地图索引百分比低,说明 Googlebot 发现了它不想收录的 URL。

查看”安全性和人工处置”(Security and Manual Actions)下的人工处置。一次人工处罚会压制所有排名,直到解决为止。这类情况罕见但严重。

规范标签(Canonical Tags)

每个可索引页面都应该携带指向自身 URL 的自引用规范标签。规范标签是一种 HTML 元素,告诉 Google 页面的哪个版本是索引的首选版本。没有规范标签的页面更容易出现重复内容问题。

检查冲突的规范信号。一个页面既用规范标签指向页面 A,又在站点地图中指向页面 B,就发出了相互矛盾的信号,Google 可能会完全忽略这个规范标签。

在 WordPress 站点上,上传媒体的附件页默认会被收录。这些是稀释抓取预算、零排名价值的薄页面。把它们重定向到父文章,或规模化加 noindex。

2. SSL 与 HTTPS 审计检查

HTTPS(HTTP 协议的安全版本)是 Google 确认的排名信号,也是浏览器安全标识的前提。SSL(安全套接层)证书通过在服务器和用户浏览器之间加密数据来启用 HTTPS。在 2025 年还在跑纯 HTTP 的网站,Chrome 会显示”不安全”(Not Secure)警告,这在排名问题出现之前,就已经压低了用户信任和点击率。

验证 SSL 证书已安装且有效。检查到期日期。证书过期未续,Chrome 会直接阻止整个页面。在到期前 30 天设置日历提醒。

确认每个页面都从 HTTP 到 HTTPS 配置了 301 重定向(永久重定向,传递全部链接权益)。302 重定向表示临时移动,传递的链接权益更少。经过多跳的重定向链,每多一跳都会流失排名信用。

用 Chrome DevTools 或 Why No Padlock 等工具扫描混合内容警告。混合内容(Mixed Content)指 HTTPS 页面通过 HTTP 加载资源。图片、脚本和样式表是最常见的元凶。Google 把带混合内容警告的页面视为不安全。

3. 技术 SEO 审计中的重复 URL 管理

重复 URL 会稀释 PageRank,并让 Googlebot 混淆该收录哪个版本的页面。选择一个规范版本,把所有替代版本用 301 重定向过去。

一开始就决定用 www 还是非 www。两者对用户来说解析到同一个网站,但在没有重定向的情况下,Google 会把它们当成两个独立域名。从不偏好的版本到偏好版本实施 301,然后确认规范标签一致。

重定向重复的首页模式。像 /index.php/index.html/default.aspx 这样的 URL 会产生多个首页版本,每一个都在拆分链接权益并增加重复内容信号。

审计克隆网站或重复子域名。最常见的来源包括:对外开放的预发布(Staging)环境、镜像主域的微站点、以及没有 hreflang 标签(告诉 Google 页面针对哪种语言和地区的 HTML 属性)的翻译版本。

4. SEO 审计中的网站安全检查

被入侵的网站会在你发现黑客之前就丢失排名。Google 的安全浏览(Safe Browsing)系统会标记托管恶意软件的网站,GSC 中的手动安全处置会把页面彻底移出索引。

定期检查 GSC 的”安全问题”(Security Issues)报告。它会标记被黑内容、恶意软件和欺骗性页面。报告干净并不保证安全,但报告有异常就必须立即行动。

用 Screaming Frog 抓取网站并导出外部链接报告,扫描可疑的出站链接。被注入指向赌博、药品或成人网站的链接,是网站被黑成功的常见指标。

验证网站是否仍然在主要品牌关键词上排名。品牌排名突然下降,可能在 GSC 报告浮出水面之前,就已经指示了处罚、被黑或去索引事件。

5. 审计重定向、错误与失效链接

重定向问题是有一定年限的网站丢失 PageRank 的最常见原因之一。每多一跳不必要的重定向,都会减少传递到目标页面的权益。

审计所有 302 重定向。临时重定向不像 301 那样传递链接权益。一个存在超过几天的 302,几乎总是应该转换成 301。

检查重定向循环。循环发生在页面 A 重定向到页面 B、页面 B 又重定向回页面 A 时。Googlebot 在有限的跳数后就会放弃抓取。

配置一个返回真正 404 服务器状态码的自定义 404 页面。软 404 是另一个问题:页面返回 200 OK 状态(意味着服务器认为页面存在),但显示的内容明显表示页面不存在。Google 把软 404 当作低质量页面,可能会收录它们。

修复失效的内链。用 Screaming Frog 抓取会导出所有 4XX 响应。从内链数量最高的条目开始逐一处理。

审查指向站外的外部链接。移除或 disavow 指向无关或低信任目标的外链。过多指向垃圾域名的出站链接是信任信号问题。

6. 技术审计中的网站性能与 Core Web Vitals

Core Web Vitals 是直接的排名因素。Google 使用 Chrome 用户的现场数据(Field Data)在 URL 层面评估 LCP(Largest Contentful Paint,最大内容绘制)、INP(Interaction to Next Paint,交互到下一帧绘制)和 CLS(Cumulative Layout Shift,累计布局偏移)。

对关键页面运行 GSC 的”网址检查”(URL Inspection)工具。检查 Core Web Vitals 报告中标记为”欠佳”(Poor)或”需要改进”(Needs Improvement)的 URL。“页面体验”(Page Experience)报告按问题类型对 URL 分组,方便批量修复。

上传前压缩图片。未压缩的图片是 LCP 分数慢的最常见原因。使用 WebP 和 AVIF 等新一代格式,为首屏以下的图片配置懒加载。

为静态资源启用浏览器缓存。缓存了 CSS、JavaScript 和图片文件的浏览器,再次访问时不会重新下载,从而减少回访用户的加载时间。

用 Chrome DevTools 在多种设备上测试响应式布局。GSC 中的移动端可用性错误会压制移动端排名。常见问题包括:文字太小无法阅读、可点击元素间距过近、视口未配置。

7. 页面 SEO 审计:元数据与标题

页面 SEO 信号告诉 Google 页面讲的是什么、是否满足搜索查询。缺失或重复的元数据是审计中见效最快的项目,因为修复成本低,且直接影响点击率。

从 Screaming Frog 导出完整的标题标签清单。标记重复、缺失以及超过 65 个字符(在 SERP 中会被截断)的标题。每个标题标签都应在靠前位置包含主要关键词,并与页面的搜索意图匹配。

检查元描述。它不是排名因素,但影响点击率。一个 155 字符以内、匹配用户意图、有吸引力的元描述,比自动生成的描述赢得更多点击。

审计 H1 标签。每个页面应该恰好有一个与标题标签意图匹配的 H1。一个页面多个 H1 会让主要主题产生歧义。完全没有 H1 则浪费了最清晰的页面相关性信号。

检查所有图片的 ALT 文本。空的 ALT 属性是错失的收录机会。写一段描述图片内容的文本。避免关键词堆砌:ALT 属性首先是可访问性,其次才是 SEO。

8. 如何审计结构化数据与 Schema 标记

Schema 标记帮助 Google 理解页面代表什么,并能在 SERP(搜索引擎结果页)中生成富结果。Schema 实现中的错误会压制这些增强功能的资格。

用 Google 的富结果测试工具(Rich Results Test)验证关键页面类型的 Schema。分别检查错误和警告。错误意味着标记无效、页面没有富结果资格;警告意味着可选字段缺失、增强效果还有改进空间。

对大多数网站来说,SERP 影响最大的 Schema 类型是 Organization、LocalBusiness、Product、FAQPage 和 BreadcrumbList。实现与网站内容和业务模式相关的那些。

FAQPage Schema 值得特别关注。它能生成手风琴式富结果,占据显著更多的 SERP 版面。每个问答都必须与页面上的可见内容一致。

BreadcrumbList Schema 支持搜索结果中的站内链接(Sitelinks)。在分类页和子分类页上一致地实现它,能同时改善 Googlebot 和用户的导航清晰度。

9. XML 站点地图审计:检查与修复什么

站点地图是你与 Googlebot 的沟通渠道。它告诉爬虫哪些 URL 你认为重要、希望被收录。维护不善的站点地图会发出相互矛盾的信号。

确认 sitemap.xml 存在,并且能在 yourdomain.com/sitemap.xml 访问。在 GSC 的”站点地图”下提交它。监控报告中已提交 URL 与已收录 URL 的比率。差距显著说明存在质量问题或抓取预算问题——抓取预算即 Googlebot 在给定时间内在网站上处理的页面数量。

站点地图中只包含可索引的 URL。被 noindex 的页面、分页重复页面和重定向 URL 不应出现。包含被 noindex 页面的站点地图自相矛盾:你同时告诉 Google 收录这个页面和排除这个页面。

从站点地图中移除失效 URL 和重定向 URL。站点地图中的每个 URL 都应返回 200 状态,并且是该页面的规范版本。

10. 分页 SEO 审计检查

分页页面是重复内容和抓取预算浪费的常见来源。Google 自 2019 年以来的指引是:让分页页面各自独立收录,用规范标签指示主要版本。

审计分页 URL 上的规范标签。每个分页页面(/page/2//page/3/ 等)都应携带自引用规范标签,而不是指回第 1 页。

确保分页页面保持可抓取。在 robots.txt 中屏蔽分页 URL,会阻止 Googlebot 发现被链接的产品或内容,降低网站的抓取深度。

11. 内容质量审计:搜索意图与薄内容

通过 Google 的有用内容系统(Helpful Content System,现已并入核心算法),内容质量是排名因素。单薄、重复或意图不匹配的内容会影响整个域名,而不只是单个页面。

检查首页是否有独特、实质性的内容。一个只用于导航或品牌宣传、没有回答用户查询内容的首页,错过了一个高权威的排名机会。

识别分类页和产品页上的关键词堆砌。不自然地重复焦点关键词,会在 Google 的质量审查过程中触发垃圾信号。目标是自然的可读性,关键词的放置方式匹配用户搜索的方式。

通过比较渲染后的 DOM 与原始 HTML 源码,扫描隐藏 SEO 内容。通过 CSS 或 JavaScript 对用户隐藏、但对 Googlebot 可见的内容,是伪装(Cloaking)信号。

验证页面层面的关键词定位是否匹配搜索意图。一个针对商业关键词、却只有纯信息内容的页面不会排名,因为它没有满足查询所暗示的用户需求。

12. 内链:任何技术 SEO 审计的关键部分

内链分配 PageRank,并告诉 Google 网站认为哪些页面最重要。内链薄弱会让高价值页面缺乏支撑,与内容质量无关。

在关键分类页和重点内容中心添加页脚链接。页脚链接出现在每个页面上,为最重要的页面创造一致的抓取路径。

用 Screaming Frog 的内链报告找出孤岛页面。孤岛页面(Orphaned Page)没有任何内链指向它。Googlebot 依赖内链发现和抓取页面。孤岛页面可能通过站点地图被发现,但它收不到任何 PageRank 流动。

为内链使用描述性锚文本。像”点击这里”或”阅读更多”这样的通用锚文本不传递任何主题信号。包含目标页面焦点关键词的锚文本,会强化该关键词的相关性。

13. 审计信任信号与 E-E-A-T

Google 的质量评估员使用 E-E-A-T(经验、专业、权威、信任)框架来评估 YMYL 话题的内容质量。YMYL(Your Money or Your Life)涵盖任何不准确信息可能影响读者财务决策、法律地位或业务成果的内容。没有可见信任信号的网站,在质量审查中得分更低。

确认以下页面存在并包含实质性内容:使用条款、隐私政策、Cookie 政策、关于我们和联系我们。缺少任何一项都是基本的信任失败。

确保社交媒体资料与网站信息一致。网站与社交资料之间的 NAP(名称、地址、电话)不一致,会削弱本地信任信号。

在合适的地方鼓励用户评论。Trustpilot 或 Google Business Profile 等平台上的已验证第三方评论,支持 E-E-A-T 的权威维度。

14. 本地 SEO 审计:Google Business Profile 与 NAP 一致性

本地 SEO 适用于任何有实体位置或地理服务区域的业务。网站信息与 Google Business Profile 不匹配,会压制本地包(Local Pack)排名。

验证每个触点的 NAP 一致性。NAP 指名称、地址和电话号码——Google 用来在网络上确认业务身份的三个数据点。NAP 必须在网站、Google Business Profile、社交媒体资料和本地目录上完全一致。

认领并完整填写 Google Business Profile。一个类别准确、营业时间完整、有照片和描述的完整资料,在本地包结果中的排名明显优于不完整或未认领的资料。

在联系页面实现 LocalBusiness Schema。包含业务名称、地址、电话、URL 和地理坐标。这能在结构化数据层面强化 NAP 信号。

15. 最终审计报告:如何排优先级和呈现修复方案

一份列出 200 个问题但没有顺序的审计报告,不会被执行。真正推动排名的交付物,是一份与预估排名影响挂钩的优先级路线图。

记录每个问题时要包含三个细节:问题是什么、出现在哪里、修复需要什么。像”修复重复内容”或”提升网站速度”这样含糊的审计条目会被降级处理,因为没人知道从哪里开始。

按严重程度对问题分组:严重(阻止收录或排名)、高(PageRank 损失或内容质量影响)、中(信任和 UX 信号)、低(边际改进)。在第一个冲刺周期内处理严重和高优先级项目。

把每个修复分配给正确的角色。开发者处理服务器端变更。文案和 SEO 专员处理内容、元数据和 Schema。

每部署一批修复后重新测试网站。技术 SEO 问题会相互作用。修复一条重定向链,可能会暴露出之前被掩盖的规范标签冲突。

技术 SEO 审计可视化指南

技术 SEO 审计工具

Screaming Frog SEO Spider 处理抓取数据、内链分析、重定向链、失效链接、元数据导出和规范标签审计。它覆盖了上面列出的大部分技术检查。

Google Search Console 直接提供 Google 官方数据:索引覆盖、Core Web Vitals、人工处置和站点地图状态。没有它,任何审计都不完整。

Google PageSpeed Insights 或 Lighthouse 提供单条 URL 上 Core Web Vitals 的实验室数据。用它诊断关键页面的具体性能问题。

Google 富结果测试工具(Rich Results Test) 验证 Schema 标记,并显示页面是否有富结果资格。

Chrome DevTools 是检查渲染后 HTML 与源码 HTML 差异、测试移动端响应式、诊断混合内容警告的首选工具。

从哪里开始

并行打开 GSC 并运行一次 Screaming Frog 抓取。先检查”覆盖面”报告。如果存在带收录错误的页面,那就是你的起点。

按顺序过完本指南的 15 个部分。可抓取性和可索引性问题会级联影响审计的每个其他领域。先修复它们,再转向 HTTPS、重定向和内容质量。

技术审计不是一次性任务。那些持续排名的网站,正是按固定周期维护抓取健康、可索引性和内容质量的网站。

技术 SEO 审计常见问题

一次技术 SEO 审计需要多长时间?

对 500 页以下的网站做一次聚焦审计需要 4 到 8 小时,包括抓取时间。10,000 页以上的大型网站需要分阶段推进:先配置抓取,再查可索引性,最后做内容质量检查。还要预留记录和排优先级的时间。

应该多久做一次技术 SEO 审计?

活跃网站每季度做一次完整审计。每周用 GSC 监控收录错误、人工处置和 Core Web Vitals 回退。任何重大网站迁移或 CMS 更新后,在变更全面传播之前立即做一次完整审计。

技术 SEO 审计最重要的部分是什么?

可索引性排第一。如果 Google 无法抓取和收录你的页面,审计中的其他一切都不重要。先看 GSC 覆盖面报告、robots.txt 和 noindex 标签,再看其他任何信号。

没有开发者,文案能做技术 SEO 审计吗?

文案可以处理审计的内容层:元数据、页面信号、Schema 验证、内容质量和规范标签。服务器端检查、HTTPS 配置、重定向实现和性能优化需要开发者权限。一次完整的审计两者都需要。