如果你只用一款工具审计网站,你会漏掉大约一半的关键问题。Google Search Console 找不到断裂的内部链接。PageSpeed Insights 不会告诉你哪些页面是孤立的。而任何传统爬虫都无法告诉你 ChatGPT 或 Perplexity 是否能真正引用你的内容。
解决方案不是花 $139/月买一个平台,而是按正确的顺序堆叠合适的免费工具——每一层覆盖其他工具无法触及的维度。
以下是我们每次审计都在用的免费六工具栈、按什么顺序执行,以及免费工具触及天花板后该怎么办。
工具栈总览
层级 | 工具 | 成本 | 能回答的问题 |
|---|---|---|---|
1. 索引与搜索健康 | Google Search Console | 免费 | Google 索引了哪些页面,为什么排除了其他页面,手动处罚,AI Overview 表现 |
2. 深度爬取与技术 | Screaming Frog SEO Spider | 免费(500 URL) | 断裂链接、重定向链、缺失元数据、canonical、hreflang |
3. Core Web Vitals | Google PageSpeed Insights | 免费 | LCP、INP、CLS,每个 URL 附带可操作的修复建议 |
4. 外链与站外 | Ahrefs Webmaster Tools | 免费(已验证站点) | 引用域、丢失的外链、锚文本分布、垃圾链接模式 |
5. 无限制爬取与批量审计 | Open SEO Crawler | 免费(开源) | 无限制 URL 爬取、CMS 感知检查、JS 与无 JS 对比、AI 爬虫屏蔽检测 |
6. AI 搜索就绪度 | Featureon.ai / VisRank / GeoScore | 免费 | AI 引擎能引用你的页面吗?结构化数据、实体清晰度、llms.txt |
按这个顺序执行。每一层都依赖前一层。在确认 Google 能索引你的页面之前去修改页面标签,纯属浪费时间。
第一层:Google Search Console(每次从这里开始)
GSC 是整个工具栈里唯一拥有 Google 一手数据的工具。没有爬虫能替代,没有 API 能替代,没有第三方估算能替代。
它能回答什么
- Google 索引了我的页面吗?如果没有,为什么?
- 我获得了多少自然流量,来自哪些查询,点击率是多少?
- 有没有手动处罚或安全问题?
- 我的页面在 AI Overview 中表现如何?
- Google 看到的移动端和桌面端有什么不同?
2026 年的变化
GSC 发布了三个改变审计方式的特性。
AI 表现报告。 一个专门的板块,将 AI Overview 和 AI Mode 的展示量和点击量与传统的自然搜索分开了。如果你的审计漏掉了这个标签页,你就对 Google 搜索表面的一部分可见性视而不见。具体占比取决于行业,但在医疗健康、SaaS 对比、B2B 研究等领域,AI Overview 展示量可能占到总搜索可见性的 15% 到 30%。忽略它,意味着你只审计了大约四分之三的存在感。
品牌词过滤。 AI 分类器现在可以在 Performance 报告中原生地将品牌查询和非品牌查询分开。这听起来是个小功能,其实不是。多年来,每次 SEO 审计都以一段尴尬的对话开始:「流量涨了!」然后「等等,那基本上都是搜我们公司名的人。」现在你只需切换一个过滤条件,就能看到真正的自然发现表现。你会发现那些看起来表现不错的页面,其实是在吃品牌认知度的红利。
平台资产。 从 2026 年中开始,你可以将 Instagram、TikTok、X 和 YouTube 账号添加为 Search Console 资产。如果你的品牌在站外发布内容,现在可以和网站用同一个仪表板,看到社交和视频内容在 Google 搜索、Discover 和新闻中的表现。
在审计中怎么用
- 打开 Indexing 下的 Pages 报告,按「未索引」原因排序。最重要的类别是「已抓取 - 当前未索引」。这通常意味着 Google 发现了这个页面,但认为不值得索引。先把质量或重复问题修好,其他一切才有意义。
- 切换到 Performance 报告,应用非品牌过滤,找出展示量高但点击率低(低于 2%)的页面。这是你能找到的最快排名胜利:页面已经出现在搜索结果里了,人们也看到了,但标题标签或元描述没能赢得点击。一个排名第 8、月均 5,000 展示量的页面,换个好标题,几周内就能升到第 5。
- 检查 AI 表现标签。如果页面在自然搜索中对同样查询有排名,但 AI Overview 展示量为零,那说明内容很可能缺少 AI Overview 偏好的结构化、可提取格式。开头 150 词内的要点式答案、表格、清晰的定义句,在这里会带来可测量的差距。
- 打开设置中的 Crawl Stats。爬取预算问题——Googlebot 在低价值 URL 上消耗预算,而重要页面要等好几天才能被重新抓取——对于超过 10,000 页的网站来说,是个无声的流量杀手。图表会告诉你 Google 是否在把爬取预算浪费在筛选参数 URL、薄标签页或重定向链上。
第二层:Screaming Frog SEO Spider(GSC 无法替代的爬虫)
GSC 告诉你 Google 索引了什么,但它不会告诉你页面之间如何链接、哪些内部链接是断裂的、重定向链在哪里浪费爬取预算。
Screaming Frog 像搜索引擎机器人一样爬取你的网站,然后以电子表格级别呈现每个 URL、每个链接、每个状态码、每个元标签。它是十多年来行业标准的桌面爬虫,免费版也是真正能打的。
免费版能力
免费版可以全功能爬取最多 500 个 URL。对于一个小型企业网站、一套 SaaS 落地页或一个聚焦的内容项目,这通常足够做一次彻底的审计。核心检查项:
- 响应状态码。按状态码排序。每个 404 都在浪费链接权重。超过两跳的 301 链都应该拉平。
- 页面标题和元描述。缺失、重复、太长、太短。全在一个可排序的列里。先修高展示量的页面(对照 GSC 交叉验证)。
- Canonical 标签。每篇博客文章的 canonical 都指向首页,这是迁移后常见的遗留问题。Frog 瞬间标记。
- H1 标签。缺失 H1、多个 H1、H1-H2 不匹配,一个视图全部可见。
- 内部链接。Internal 标签页显示每个页面的入站内部链接数。内部链接为零的页面就是孤立的。搜索引擎也许能找到它们,但不会传递权重。
- 重定向链。Response Codes 标签页包含重定向链列。超过两跳的链在燃烧爬取预算。
- 图片。缺失 alt 文本、超过 100KB 的超大图片、断裂的图片 URL,全在 Images 标签页里。
500 URL 限制的变通方案
超过 500 页的网站大多有结构性规律。与其爬取所有页面,不如按模板类型分开爬:博客索引页、产品分类页、标签页。你在 500 个产品页上发现的问题,和其他 5,000 个页面完全一样。修好模板,修复就会连锁生效。
真正需要无限制爬取时,Open SEO Crawler(第五层)零成本填补这个缺口。
第三层:Google PageSpeed Insights(速度既影响排名,也影响留客)
PageSpeed Insights 整合了其他免费工具无法同时提供的两种数据源:来自 Lighthouse 的实验室数据(在限速连接上模拟加载),和来自 CrUX 的现场数据(真实 Chrome 用户访问你的页面时的数据)。
关键的三项指标
指标 | 衡量内容 | 目标 |
|---|---|---|
LCP(Largest Contentful Paint) | 主要内容何时可见 | 低于 2.5 秒 |
INP(Interaction to Next Paint) | 页面响应点击和触控的速度 | 低于 200 毫秒 |
CLS(Cumulative Layout Shift) | 视觉稳定性。内容会跳来跳去吗? | 低于 0.1 |
审计工作流
- 测试你的首页、一篇博文、一个产品页、一个分类或合集页。这四个模板就代表了你大部分流量。不要逐个审计 50 个 URL。修模板,再测量。
- 优先看现场数据,而非实验室数据。如果 CrUX 显示真实用户的 LCP 很差,无论实验室测试有多干净,你的访客正在体验的就是慢速。我见过无数次实验室得分 95+,现场得分 40 多的情况。现场数据才是真相。
- 分数下方的 Opportunities 和 Diagnostics 部分是最可操作的内容。它们指名道姓地告诉你哪些具体文件或资源在拖慢页面:未优化的图片、阻塞渲染的 JavaScript、过大的 DOM。每个项目都附带了预估节省时间。
- 用 GTmetrix 对同样页面跑瀑布图。PageSpeed Insights 给你分数和建议,GTmetrix 则展示每个资源的确切加载顺序——这是调试慢速第三方脚本或最后加载导致整个布局偏移的字体时真正需要的东西。
一个提醒:PageSpeed Insights 一次只测一个 URL。要做全站速度审计,要么搭配 Screaming Frog 的批量 PageSpeed Insights 集成(付费),要么抽样检查高流量模板。
第四层:Ahrefs Webmaster Tools(免费的强力外链分析)
Ahrefs Webmaster Tools(AWT)是 Ahrefs 面向已验证站点所有者的免费版。它最有用的审计功能不是站点爬取——Screaming Frog 和 Open SEO Crawler 零成本就能搞定。真正值钱的是外链数据。
外链为什么仍然重要
Google 在某些行业中降低了链接作为直接排名因素的权重,但它仍然是最强的站外信任信号。对于审计来说,尤其有两件事关键:断裂的外链等于浪费的权重,而垃圾链接模式可能触发手动处罚或算法降权。
AWT 审计工作流
- 打开 Backlinks 报告,按 Best links(最高 DR)排序。找出指向你站点死链接的域名或页面。每一个都是一条等待重新夺回权重的 301 重定向。这是任何审计中投入产出比最高的五分钟修复。我检查过的几乎每个站都至少有一个这样的链接。
- 检查 Anchors 报告。如果超过 60% 的锚文本是品牌名或纯 URL,你就没有获得描述性锚文本提供的主题相关性信号。如果超过 20% 是精确匹配的商业锚文本,对 Google 和用户来说都显得不自然。
- 看 Referring domains 随时间变化的趋势。低 DR 域名突然暴增且锚文本是垃圾内容,这是负面 SEO 的典型特征。AWT 的图表数秒之内就能暴露这个模式。只在看到明确攻击模式时才使用 disavow。大多数情况下,Google 会自动忽略低质量链接。
- 用 Site Explorer 查看竞争对手的外链概况。按 Best links 排序,筛选出链接了多个竞争对手但没有链接你的域名。这些都是成功率最高的外链目标——这些站点已经对你的领域表现出了兴趣。
AWT 的 Site Audit 作为第二意见
AWT 内置的 Site Audit 在免费计划下每月可爬取大约 10,000 个 URL。它会标记 100 多个技术问题并附上修复建议。在 Screaming Frog 之后做第二轮扫描使用。AWT 能抓到一些 Frog 抓不到的问题,特别是 hreflang 实现和 Schema 验证方面。设置每周自动运行,有新问题时邮件通知你。
第五层:Open SEO Crawler(无限制、自托管、无上限)
Screaming Frog 的 500 URL 限制是免费审计中最常见的痛点。Open SEO Crawler 彻底抹除了这个天花板。
一款开源、MIT 许可的桌面爬虫,在 macOS、Windows、Linux 上本地运行。不需要账号、不需要 API 密钥、不依赖云服务。无 URL 限制爬取任何网站,导出为 XLSX。每天自动更新,无需手动打补丁。
什么情况下用它代替 Screaming Frog
场景 | 选择 |
|---|---|
站点少于 500 URL | Screaming Frog。UI 更好,报告更精良。 |
站点超过 500 URL | Open SEO Crawler |
需要 CMS 特定检查(Shopify、WordPress、Webflow) | Open SEO Crawler |
需要 JS 与无 JS 渲染对比 | Open SEO Crawler |
需要 AI 爬虫屏蔽检测 | Open SEO Crawler |
需要爬取预算分析 | Open SEO Crawler |
新手第一次做审计 | Screaming Frog |
开发者或技术 SEO | 两者皆可。OSC 给出更多原始数据。 |
审计中真正有用的功能
CMS 感知爬取。它理解 Shopify 合集页面、WordPress 标签存档、Webflow CMS 列表页面。检查薄内容或重复内容时误判更少。
AI 爬虫屏蔽检测。它检查你的 robots.txt 是否无意中屏蔽了 GPTBot、CCBot、Claude-Web、PerplexityBot。一条错误的 Disallow 规则,就能让你的内容对 AI 答案引擎完全不可见,即使 Google 可以正常索引。我审计的站点中大约每十个就有一个存在这种情况。
JS 与无 JS 对比模式。Google 会渲染 JavaScript,但不是每次都及时。这个模式分别以开启和关闭 JS 的方式爬取,告诉你 Googlebot 首轮抓取时可能漏掉什么内容。
软 404 检测。返回 200 状态码但包含「没有找到结果」之类空状态的页面会被标记。这在筛选后的电商页面和站内搜索结果页面中随处可见。
从 GitHub 仓库安装,用 open-seo-crawler 运行,指向你的域名。第一次爬取最慢,后续运行会缓存已知 URL,速度更快。
第六层:AI 搜索就绪度(大多数审计跳过的一层)
传统 SEO 审计回答一个问题:Google 能找到我的页面、索引它、给它排名吗?
2026 年的审计还需要回答第二个问题:ChatGPT、Perplexity、Claude、Gemini、Google AI Overview 能引用我的内容吗?
这是两个不同的问题,需要不同的检查。一个在 Google 排名第 3 的页面,可能在 AI 答案引擎中完全不可见。原因多种多样:缺少结构化数据、实体信号薄弱、内容埋在散文中而不是为提取而构建的。
三个真正有效的检查
1. AI 爬虫能访问你的内容吗?
打开你的 robots.txt 文件,搜索这些用户代理令牌:GPTBot、CCBot、Claude-Web、PerplexityBot、Google-Extended、Anthropic-AI。如果其中任何一个出现在 Disallow 指令下,你就在阻止 AI 引擎抓取你的内容。有些 CMS 平台默认就会添加这些屏蔽规则。大多数团队根本不知道它们在那里。
2. 你的内容是为提取而构建的吗?
AI 答案引擎偏好容易分离出答案的页面。用这个清单检查你流量最高的 20 个页面:
- 主要答案是否在前 150 个词内清晰可见?
- 关键主张是用要点列表或简短表格呈现,而不是埋没在第三段冗长文字里?
- 每个章节标题真的描述了该章的内容吗?
- 统计数据和定义是否关联到了具体的出处?
3. 你有 AI 系统能解析的结构化数据吗?
至少每个页面都应该有 Article 或 WebPage Schema。FAQ 页面应该保留 FAQPage Schema——虽然 Google 在 2026 年 5 月移除了 FAQ 富媒体搜索结果,但这个 Schema 仍然帮助 AI 系统提取问答对。产品页需要 Product Schema。本地商家需要 LocalBusiness Schema。
用 Google 的富媒体结果测试工具验证,快速免费。
免费的 GEO 和 AEO 审计工具
工具 | 检查内容 | 费用 |
|---|---|---|
Featureon.ai | AI 可见度评分、语义清晰度、面向答案引擎的权威信号 | 免费 |
VisRank | SEO、AEO、安全性、本地存在的 49 个信号,给出 0-100 分 | 免费 |
GeoScore | 完整开源审计:GEO 预测、llms.txt 生成器、EEAT 记分卡 | 免费(Cloudflare 自部署) |
GEO Optimizer | 47 种研究支持的方法,8 个类别的 1,720 项测试,含 AI 引用历史 | 免费(MIT 许可) |
Grow Predictably GEO Audit | 五维 GEO 评分:权威性、可读性、结构、答案对齐、AEO 可提取性 | 免费(每天 3 次) |
至少用一个工具跑一下你的首页。你通常会发现一到两个高影响力的修复点,十分钟就能搞定:缺失的 llms.txt 文件、Schema 缺口、AI 爬虫的 robots.txt 屏蔽。如果需要第二个数据参考点,Auspia 的免费 AI 搜索可见度检查器会在相似的维度上评估你的域名,无需注册。
完整审计流程
顺序很重要。按这个顺序执行工具:
- Google Search Console。检查索引状态、手动处罚、AI 表现。找出高展示量低点击率的页面。导出 URL 列表。
- Screaming Frog(超过 500 URL 的站点用 Open SEO Crawler)。爬取断裂链接、重定向链、缺失和重复的元标签、孤立页面、canonical 错误。
- PageSpeed Insights + GTmetrix。测试四个关键页面模板。从 Opportunities 标签页收集具体的文件级建议。
- Ahrefs Webmaster Tools。检查断裂的入站链接、锚文本分布、负面 SEO 模式。用 Site Audit 做第二轮技术扫描。
- Open SEO Crawler。如果第一轮用了 Screaming Frog,再用 OSC 覆盖 Frog 不检查的部分:AI 爬虫屏蔽检测、JS 对比模式、CMS 特定问题、软 404 检测。
- 一个 GEO 或 AEO 工具。在首页和流量前五的页面上运行 Featureon.ai 或 VisRank。修复 AI 爬虫屏蔽、缺失的结构化数据、可提取性缺口。
时间估计:500 页以下的站点需要 2-3 小时,大站需要 4-6 小时。大部分时间花在分析输出和决定修什么上,而不是花在运行工具上。

免费工具的瓶颈在哪里
免费工具栈大约覆盖了付费审计平台 80% 的能力。以下是不足之处以及对策。
限制 | 免费变通方案 | 何时该升级 |
|---|---|---|
超过 500 URL 的爬取(Screaming Frog) | 使用 Open SEO Crawler | 需要 Frog 的高级功能,如自定义提取和规模化 JS 渲染 |
一次只能测一个 URL 的 PageSpeed | 按模板测试,而非按 URL 逐个测试 | 需要对数百个页面进行持续性能监控 |
外链数据仅限于自有站点(AWT) | 使用竞争对手域名重叠分析 | 需要完整的竞争外链研究 |
没有跨关键词排名追踪 | 使用 GSC 平均排名 + 查询筛选 | 需要每天追踪数百个关键词的排名 |
每次手动审计耗时数小时 | 建立检查清单并模板化 | 每月审计次数超过一次 |
没有 AI 引用随时间变化的监测 | 用 GEO 工具抽查 | AI 可见度成为核心 KPI 时 |
发现问题是一回事,修好是另一回事 | 定期运行工具,在表格中追踪修复动作 | 需要自动监控和告警来闭环 |
「免费工具够用」和「需要自动化」的分界线每个团队不同。一个可靠的信号是:如果你连续三次审计都发现了同样的问题,因为两次审计之间没人有时间修——那瓶颈不是发现问题,而是执行。

当审计循环需要自己闭合时
免费工具栈能告诉你怎么坏了,但它不会帮你修。它不会追踪修复是否奏效,不会告诉你下周该优先做什么。
Auspia 填补的就是这个空白。它不是 Google Search Console 或 Screaming Frog 的替代品。它位于这些工具之上:连接你的 GSC、爬取你的网站、读取你的内容,并且按天——而非按季度——运行「审计 → 修复 → 衡量」循环。
实际运作方式如下。
你连接域名。Auspia 读取你现有的页面、GSC 数据、产品定位、竞争对手格局。不用搭表格,不用维护 URL 列表。
然后,你收到的不是一份 140 个问题、你永远不会完整消化的审计报告,而是每天一个优先动作。一条阻塞关键页面的索引问题。一个竞争对手刚刚填补的内容缺口。一个排名正在下滑、需要刷新的页面。
接下来,它会追踪结果。已发布的内容会被监控索引状态、排名和点击量。获得增长势头的页面会被扩展。停滞不前的页面会被替换。审计间隔期新出现的技术问题会在积累成更大问题之前被标记。
这不是「跑一次免费审计然后自己干活」。而是审计在持续运行,每天把投入产出比最高的动作推到你面前。
对于小到「谁来负责 SEO 审计」都还是一个真实问题的小团队来说,本文的免费工具栈覆盖了诊断层。Auspia 覆盖了执行层,按天循环,每月不到 $200。
从免费审计扫描开始,无需信用卡。
作者:Julian Mercer,Auspia 14 年经验的技术 SEO 从业者。Julian 撰写关于可抓取性、网站架构、技术审计工作流,以及让这些工作流快得真正能用起来的工具。












