简短回答
多语言SEO是指让你的网站在多个语言的搜索引擎中获得可见性的做法。到了2026年,这不仅仅是翻译页面并添加hreflang标签那么简单。Google现在会自动翻译英文内容,并通过其自有代理域名提供——如果你没有原生语言版本,它就会抢走你的流量。AI Overviews涵盖200多个国家和40多种语言,而ChatGPT、Perplexity和Gemini等AI引擎现在会根据语言特定的信号来决定引用哪些品牌。
好消息是:你不再需要一支10人的本地化团队了。借助Claude Code (Codex)的agent工作流,一名独立SEO从业者就可以审计数百个页面的hreflang、研究自己不会说的语言的搜索关键词、检查翻译质量,并监测国际可见性——全部使用免费工具和本指南中的提示词模板即可完成。
在本文中,你将学习一个七步工作流,用于构建一个既能在传统搜索中排名、又能在AI回答中获得引用的多语言网站,外加四个即拿即用的AI agent技能来自动化处理最繁琐的部分。
多语言SEO vs. 国际SEO:有什么区别?
这两个术语经常被混淆。以下是二者的区别:
多语言SEO | 国际SEO | |
|---|---|---|
目标用户 | 说不同语言的用户(西班牙语、法语、德语) | 特定国家或地区的用户,即使他们说的是同一种语言 |
示例 | 一个拥有英语、西班牙语和法语版本的网站 | 一个为美国、英国、加拿大和澳大利亚分别设置独立页面的网站——全部使用英语 |
关键技术 | 翻译 + 按语言进行本地化 | 针对特定国家的内容 + 带地区代码的hreflang |
对搜索引擎的信号 | 语言注释( | 语言+地区注释( |
大多数全球网站两者都需要。一个加拿大电商网站可能需要英语版本(en-CA)、法语版本(fr-CA),还需要西班牙语版本(es)来服务日益增长的西语受众——将多语言SEO和国际SEO融合在一个策略中。
为什么多语言SEO在2025–2026年发生了剧变
三个重大变化从根本上改变了跨语言获取可见性所需的条件:
变化一:Google在自动翻译你的内容——并截留了流量
自2025年3月核心更新以来,Google大幅扩展了其自动翻译行为。当用户用西班牙语搜索,但Google找不到有力的西语来源时,它会抓取一篇权威的英文页面,实时机器翻译,然后通过一个Google拥有的代理域名(www-your-site-com.translate.goog)提供。
这些流量根本不会到达你的网站。点击被记录为translate.google.com / referral,而不是google / organic,破坏了你的归因。代理页面上的内部链接指回Google,将用户留在Google的生态系统中。
解决办法简单但紧迫: 为每个高流量页面至少创建一个300字的原生语言版本。Google自身的研究表明,即使是最低限度的本地化页面,通常也能在SERP中将代理版本排挤出去。优先为你排名前20的页面做这件事。
变化二:AI Overviews已覆盖全球——并且它们引用本地语言来源
Google AI Overviews现在出现在200多个国家和40多种语言中。查询使用的语言是AI引擎决定引用什么内容的最强信号之一。
Weglot对130万次AI Overviews引用进行了分析,结果发现,拥有翻译内容的网站在AI Overviews中的可见性比单语言网站高出327%。在一项针对墨西哥西班牙语的后续研究中,96%的Google AI Overviews引用来源是西班牙语来源。
这意味着即使在英语中排名靠前,也不再能保证在非英语查询中获得AI可见性——即使你的英语内容非常出色。
变化三:AI Agent现在能承担繁重工作
Claude Code及类似的AI编程agent已经变得足够强大,可以自动化多语言SEO中最乏味的部分。到了2026年,你只需运行一条提示词,就能获得:
- 整个网站的完整hreflang审计
- 任何语言的搜索关键词研究,包含搜索量和意图标签
- 翻译质量检查,将你的本地化页面与母语竞争对手进行对比
- 每周国际可见性监测,覆盖传统搜索和AI回答呈现
我们将逐一介绍这些agent工作流,并在下面的步骤中提供完整、可直接复制使用的技能文件。
步骤一:选择你的目标市场(用数据,而不是猜测)
在翻译一个字之前,先弄清楚哪些语言和市场对你的产品/服务实际上有需求。
你需要什么
- Google Analytics 4(GA4)或类似的流量分析工具
- Google Search Console访问权限
- 15分钟
如何操作
检查你的现有流量。 在GA4中,前往Reports → Demographics → Demographic details,然后将主维度切换为"Country"。寻找向你的英文页面持续发送自然流量的国家。如果德国每月向英文内容发送500次自然访问,那么德语内容的需求很可能是3-5倍。
检查Search Console。 前往Performance → Countries。按点击量筛选,查看每个国家的平均点击率。在非英语国家中点击率偏低,通常意味着用户找到了你的页面,但因为语言不通而离开。
用三个因素给每个市场打分:
- 现有需求(1–5):目前有多少自然流量来自该国家或语言?
- 竞争差距(1–5):本地竞争对手有多强?在目标国家的Google域名(如
google.de、google.fr)上搜索你的前5个关键词,统计搜索结果首页中有多少页面来自主要使用本地语言发布的网站。 - 业务匹配度(1–5):你能发货到那里吗?支持当地货币吗?有该语言的客户服务吗?
将三个分数相乘。得分60+的市场应作为首要优先级;30–59分是第二波候选市场。
用Claude Code自动化此流程
将下面的技能文件复制到.claude/skills/multilingual-market-scorer/SKILL.md,然后在Claude Code中运行/multilingual-market-scorer:
---
name: multilingual-market-scorer
description: 分析GA4和GSC数据,为目标市场打分并排名,用于多语言SEO扩展规划
---
# 多语言市场评分器
利用现有分析数据对潜在目标市场进行评分。此技能帮助你优先确定哪些语言和国家应首先进行多语言SEO扩展。
## 前置条件
- 用户已分享GA4和GSC数据(各平台的CSV导出)
- 用户已定义其排名前5的英文目标关键词
- 用户了解其业务限制(可配送区域、支持的货币、客服语言)
## 输入
1. GA4国家级别的自然流量导出(CSV)
2. GSC国家级别的效果导出(CSV)
3. 排名前5的英文目标关键词
4. 业务目前运营的国家/地区列表
## 工作流
### 阶段一:提取需求信号
- 解析GA4 CSV,提取:国家、月度自然访问会话数、按国家划分的转化率
- 解析GSC CSV,提取:国家、点击量、展示量、平均点击率、平均排名
- 按国家名称合并两个数据集
### 阶段二:为每个市场打分
对每个有可衡量流量的国家:
- **需求得分(1-5):** 基于月度自然访问会话数。低于100 = 1,100-500 = 2,500-2000 = 3,2000-5000 = 4,5000以上 = 5
- **机会得分(1-5):** 基于平均点击率。低于1% = 5(高机会——用户找到了你但读不懂),1%-2% = 4,2%-4% = 3,4%-7% = 2,7%以上 = 1
- **业务匹配度(1-5):** 用户必须根据其是否在该国运营来提供。未知时默认为3。
### 阶段三:排名与推荐
- 将需求 × 机会 × 业务匹配度相乘,得出综合分数(最高125)
- 第一梯队(60+):即时优先——立即为这些市场启动本地化
- 第二梯队(30-59):第二波候选——计划下个季度推进
- 第三梯队(低于30):持续监测——待第一、第二梯队上线后再重新评估
- 输出排名表格,包含:国家、主要语言、综合评分、需求得分、机会得分、业务匹配度、推荐URL结构、预计需本地化的页面数量
### 阶段四:输出优先级行动计划
- 首先应针对的3个市场,附推荐语言和URL结构
- 首先应本地化的页面列表(基于GSC中每个国家的热门页面)
- 预计字数和翻译预算(使用当前AI翻译API定价)
- 风险提示:列出高需求+低点击率、但业务不运营的国家——标记为需要战略决策的项目
## 输出
一份结构化报告,包含:
1. 市场优先级表格(所有国家均已打分和分级)
2. 排名前3的推荐市场及理由
3. 第一波本地化页面列表(每个市场最多20页)
4. 预计预算和时间表
5. 标记出的战略空白区域
## 局限性
- 所有分数均为基于可用数据的估计——真实世界表现会有差异
- 不能替代母语市场调研或本地竞争分析
- GA4和GSC数据反映的是当前英文表现,而非潜在的非英语需求
- 不访问付费API;依赖用户提供的CSV导出步骤二:为每种语言做搜索关键词研究(即使你不会说那种语言)
跨语言的关键词研究过去需要每个市场都有母语SEO专员。到了2026年,你可以用免费工具和AI辅助完成80%的工作——然后用母语者验证剩下的20%。
流程
从你的热门英文关键词开始。 选择为你的英文网站带来最多自然流量的10-20个关键词。
翻译——然后本地化。 使用DeepL或Google Translate获得每个关键词的第一轮翻译。然后对照真实搜索行为进行检查:
- 前往目标国家的Google域名(例如,西班牙用
google.es,德国用google.de) - 在搜索栏中开始输入翻译后的关键词
- 查看Google Autocomplete的建议——这些揭示了真实用户实际如何表达搜索
- 滚动到SERP底部查看"相关搜索"
示例:将"Running shoes"翻译为德语
- 直接翻译:"Laufschuhe"
- Google.de的自动完成显示:"Joggingschuhe"、"Sportschuhe"、"Laufschuhe Herren"
- 你现在有了三个关键词变体可以定位,而不仅仅是字面翻译
检查搜索量。 使用Google Keyword Planner并将目标设为目标国家,或者使用Ahrefs/Semrush等工具并启用国家筛选器。免费替代方案:在目标国家的Google上搜索该关键词,查看排名靠前的页面——如果这些页面内容详实、更新频繁且拥有大量外链,该关键词很可能具有可观的搜索量。
用母语者验证。 对于每种语言排名前10的关键词,支付母语者在Upwork等平台上20-50美元,让他们审核你的关键词列表,并标记任何听起来不自然或遗漏常见本地变体的词语。这项15分钟的检查可以捕捉到AI翻译持续忽略的错误。
用Claude Code自动化此流程
---
name: multilingual-keyword-research
description: 为任何目标语言和国家生成并验证本地化关键词列表,结合AI翻译和SERP验证
---
# 多语言关键词研究Agent
为任何目标语言和市场生成本地化关键词研究报告。结合AI翻译和SERP验证步骤,生成反映真实用户搜索方式的关键词列表。
## 前置条件
- 用户已定义目标国家(ISO代码)和语言
- 用户提供了10-20个英文(或其他源语言)种子关键词
- 用户可访问Google Keyword Planner、DataForSEO,或可以手动进行SERP检查
- 基础工作流无需API密钥;DataForSEO集成是可选的,用于自动化搜索量数据
## 输入
1. 目标国家(如`DE`、`ES`、`JP`)和语言(如`de`、`es`、`ja`)
2. 10-20个源语言的种子关键词
3. 业务类别或行业(用于提供上下文)
4. 可选:DataForSEO API凭据(用于自动化搜索量数据)
## 工作流
### 阶段一:翻译和扩展种子关键词
对每个种子关键词:
- 使用AI生成第一轮目标语言翻译(注明使用了哪个模型)
- 识别3-5个自然变体:同义词、更长的长尾表达、问题形式、本地术语
- 标记任何直接翻译可能与当地搜索习惯不符的关键词
### 阶段二:SERP验证(手动或自动化)
对每个翻译后的关键词:
- 在目标国家的Google域名上检查Google Autocomplete——记录排名前5的建议
- 检查SERP底部的"相关搜索"——记录所有相关词语
- 如果DataForSEO可用:查询每个关键词的搜索量、CPC和竞争度
- 如果DataForSEO不可用:注明此情况,并提供手动Keyword Planner查询的指南
### 阶段三:按搜索意图聚类
将关键词分组:
- **信息型:** "什么是X"、"如何Y"、指南、定义
- **商业型:** "最佳X"、"X vs Y"、评测、对比
- **交易型:** "购买X"、"X价格"、"X附近"、产品名称
- **导航型:** 品牌名称、特定网站搜索
### 阶段四:优先级排序
对每个关键词组按以下维度评分:
- 与业务的相关性(1-5)
- 预估搜索量级别(低/中/高——如果API数据不可用,不要虚构具体数字)
- 基于SERP分析的竞争水平(首页优化良好的页面数量、广告密度)
- 内容空缺:用户在该语言中是否已有针对此关键词的内容?
### 阶段五:输出关键词地图
对排名前20的关键词:
- 目标语言的关键词
- 英文翻译(供用户参考)
- 搜索意图类别
- 搜索量级别(低/中/高)
- 推荐内容类型(着陆页、博客文章、产品页面、词汇表条目)
- 如果有任何语言版本的现有内容可以适配,列出其现有URL
## 输出
一份结构化的关键词研究报告,包含:
1. 市场概览:发现的关键词机会总数、意图分布、搜索量概览
2. 排名前20的优先级关键词及完整元数据
3. 内容映射:哪些关键词对应哪些现有或新页面
4. 母语者验证清单:排名前10的关键词发送给母语者审核,并附上具体问题("[关键词]听起来自然吗?当地人通常会怎么说?")
5. 使用的数据来源、检索日期以及数据空缺(哪些关键词缺少搜索量数据)
## 局限性
- AI关键词翻译是起点,不是最终答案——始终用母语者验证
- 搜索量数据是数据提供方的估算值;实际搜索量因季节和市场条件而异
- 除非用户已配置付费关键词API,否则无法访问;提供手动回退方案说明
- 无法在缺乏母语输入的情况下捕捉超小众的本地俚语或新兴用语步骤三:选择正确的URL结构
每个语言版本的页面都需要自己的URL。你有三种选择,正确的选择取决于你的资源和目标。
三种选择
结构 | 示例 | SEO权威性 | 成本与维护 | AI爬虫兼容性 | 最适合 |
|---|---|---|---|---|---|
子目录 |
| 统一在一个域名上——整体最强 | 低——一台服务器、一个CMS | 极佳——同一域名,路径信号清晰 | 大多数网站;成长型企业;10人以下团队 |
子域名 |
| 被视为独立站点——权威性分散在各子域名 | 中——每种语言需要独立托管/配置 | 良好——但每个子域名需独立爬取 | 大型企业;各语言产品目录截然不同的网站 |
ccTLD |
| 最强的国家信号,但每个域名权威性从零开始 | 高——独立域名、托管,通常还需独立法人实体 | 良好——但每个域名的权威性必须从零开始积累 | 拥有当地办公室的老牌品牌;ccTLD作为信任信号的市场(德国、日本) |
给初学者的建议: 使用子目录结构(example.com/de/、example.com/es/)。它们设置、追踪和维护最为简单。所有SEO权威性集中在一个域名上。Google的John Mueller一直表示子目录非常适合多语言网站。
一条关键规则
永远不要基于用户IP地址自动重定向。 Googlebot主要从美国IP地址进行抓取。如果你将美国IP的爬虫重定向到英文版本,Google将永远看不到你的德语或日语页面。应使用语言/地区选择器(横幅或下拉菜单),而不是强制重定向。

步骤四:本地化——而不仅仅是翻译
翻译转换的是词语。本地化适配的是含义、上下文、示例和文化引用。到了2026年,这二者之间的差异决定了Google是展示你的页面还是其自己的自动翻译代理版本。
2026年的AI翻译工具格局
工具 | 方式 | Hreflang自动生成 | 服务端渲染 | 最适合 | 起步价格 |
|---|---|---|---|---|---|
DeepL | 神经机器翻译API | 否(需要独立实现) | N/A(API——由你控制渲染) | 高质量第一轮翻译;欧洲语言对 | 免费版;Pro版约$9/月起 |
Weglot | 云端多引擎(DeepL + Google + Gemini + OpenAI)+ 学习品牌语调的自定义AI模型 | 是——自动化 | 是——代理层渲染真实HTML | 一体化解决方案;希望在1小时内设置的初学者 | $17/月起 |
GTranslate | 通过代理层的Google Translate引擎 | 是——付费版 | 是——付费版 | 预算选项;简单网站 | 免费(不被索引);付费版约$8/月起 |
WPML | WordPress插件——数据库存储翻译 | 手动设置 | 是(WordPress原生) | 拥有内部翻译团队的WordPress网站 | 约$39/年起 |
TranslatePress | WordPress插件——可视化前端编辑器 | 手动设置 | 是(WordPress原生) | 想要可视化编辑的WordPress初学者 | 免费;Pro版约$8/月起 |
安全的AI翻译工作流
AI翻译快速且便宜,但直接发布原始AI输出的内容是有风险的。Google的政策没有禁止AI翻译的内容,但会处罚低质量的翻译。以下是安全的工作流:
- AI第一轮翻译: 使用DeepL、Weglot或ChatGPT/Claude翻译页面。
- 自动QA检查: 运行Claude Code翻译质量agent(见下文)来标记:未翻译段落、术语表违规、文本膨胀问题(德语比英语长约30%)、以及缺失的元数据翻译。
- 对高影响力页面进行人工审核: 首页、定价页面、法律页面和流量前5的页面由母语者审核。博客文章、FAQ和帮助文档可以依赖AI + 自动QA。
- 元数据双重检查: AI通常会将meta标题、meta描述、图片alt文本和URL别名保留在源语言中。这些必须手动翻译和本地化——因为它们是SERP中展示的内容。
翻译质量检查Agent
---
name: translation-quality-check
description: 审计AI翻译页面的常见质量问题——未翻译内容、术语表违规、文本膨胀、元数据缺失和本地化一致性
---
# 翻译质量检查Agent
审核AI翻译或人工翻译的页面是否存在常见的多语言SEO质量问题。生成一份优先级修复列表。
## 前置条件
- 用户提供源页面和翻译后页面的URL或HTML文件
- 用户可选提供术语表文件(CSV:源语言术语、目标语言术语、注释)
- 用户指定源语言和目标语言
## 输入
1. 源页面URL或HTML文件路径
2. 翻译后的页面URL或HTML文件路径(可为多种目标语言)
3. 源语言代码(ISO 639-1)
4. 目标语言代码(ISO 639-1)
5. 可选:用于术语一致性的术语表CSV
6. 可选:品牌语调指南或翻译记忆备注
## 工作流
### 阶段一:结构检查
对每个翻译后的页面:
- 验证页面是否有唯一的、已翻译的URL(不是与源页面相同的URL)
- 验证HTML `lang`属性是否与目标语言匹配
- 验证页面是否提供真实的HTML(而非客户端JS翻译)——检查翻译后的文本是否存在于原始HTML源代码中
- 检查所有meta标签是否已翻译:`<title>`、`<meta name="description">`、`<meta property="og:title">`、`<meta property="og:description">`
### 阶段二:内容覆盖检查
对比源页面和翻译后的页面:
- 统计`<h1>`到`<h4>`标题——确认全部已翻译
- 检查图片`alt`属性——标记任何仍停留在源语言的部分
- 检查按钮文本、表单标签、错误提示、页脚链接——这些经常被遗漏
- 检查结构化数据(JSON-LD)——标记schema内容是否停留在源语言
### 阶段三:翻译质量指标
标记潜在的质量问题:
- **未翻译段落:** 出现在翻译后页面上的源语言文本块
- **文本膨胀/截断:** 比较关键元素(标题、CTA、导航项)的字符数。标记目标语言字符数超出40%以上的元素(存在SERP和UI截断风险)
- **术语表违规:** 如果提供了术语表,检查定义的术语是否使用了批准的翻译
- **术语不一致:** 同一源语言术语在同一页面上被翻译为不同的目标语言(例如,"checkout"在同一德语页面上被翻译为"Kasse"和"Zur Kasse gehen")
### 阶段四:本地化深度检查
对页面进行本地化质量评分(不仅是翻译准确性):
- **示例和引用:** 案例研究、统计数据和示例是否已本地化,还是仍以美国/英国为中心?
- **货币、日期、度量单位:** 是否采用本地格式?
- **文化标记:** 货币符号、地址格式、电话号码格式
- **图片:** 图片中的文字是否为目标语言,还是仍停留在源语言?
### 阶段五:输出优先级修复列表
问题分类:
- **严重(上线前必须修复):** 缺少hreflang、标题/元描述未翻译、lang属性错误、仅客户端渲染
- **高(1周内修复):** 未翻译的标题、缺少alt文本、schema语言错误
- **中(1个月内修复):** 术语不一致、UI文本未翻译、文本膨胀风险
- **低(改进待办):** 示例未本地化、图片含源语言文字、格式问题
## 输出
一份结构化的质量报告,包含:
1. 整体质量评分(A–F)和摘要
2. 严重问题列表(附精确的元素定位)
3. 高优先级问题列表
4. 源页面与翻译后页面的逐元素对比表
5. 母语者审核清单:预算有限时优先审核的具体部分
6. 按优先级分层的预估修复时间
## 局限性
- 自动化检查无法评估自然度、惯用地道程度或文化细微差别——仍需母语者进行最终审核
- 术语表匹配仅为精确字符串匹配;没有全面的术语表则无法捕捉词形变化
- 不评估相对于参考译文的翻译准确性——这是一项覆盖度和一致性检查,而非流利度评估步骤五:实现Hreflang标签(避免8个最常见的错误)
Hreflang标签告诉搜索引擎:"这个页面是那个英文页面的德语版本。"没有它们,Google可能会向用户提供错误的语言——或者将语言版本视为重复内容,只索引其中一个。
实现Hreflang的三种方式
1. HTML `<link>` 标签(最适合大多数网站)
在每页的 <head> 中添加以下代码:
<link rel="alternate" href="https://example.com/blog/" hreflang="x-default">
<link rel="alternate" href="https://example.com/blog/" hreflang="en">
<link rel="alternate" href="https://example.com/blog/de/" hreflang="de">
<link rel="alternate" href="https://example.com/blog/es/" hreflang="es">
<link rel="alternate" href="https://example.com/blog/fr/" hreflang="fr">至关重要的是,每个页面也必须引用自身。 德语页面(/de/)必须包含完全相同的一组标签——包括一个用hreflang="de"指向自身的标签。这被称为自引用标签,Google对此有强制要求。
2. XML Sitemaps(最适合20种以上语言)
如果你管理数十个语言版本,在每页上维护 <link> 标签会变得难以管理。改用XML sitemap:
<url>
<loc>https://example.com/blog/</loc>
<xhtml:link rel="alternate" hreflang="en" href="https://example.com/blog/"/>
<xhtml:link rel="alternate" hreflang="de" href="https://example.com/blog/de/"/>
<xhtml:link rel="alternate" hreflang="es" href="https://example.com/blog/es/"/>
<xhtml:link rel="alternate" hreflang="x-default" href="https://example.com/blog/"/>
</url>3. HTTP Headers(用于非HTML文件)
用于PDF、图片或API响应:
Link: <https://example.com/brochure.pdf>; rel="alternate"; hreflang="en"
Link: <https://example.com/brochure-de.pdf>; rel="alternate"; hreflang="de"8个最常见的Hreflang错误
# | 错误 | 为何会出问题 | 如何修复 |
|---|---|---|---|
1 | 缺少自引用标签 | 每个页面必须在其自身的hreflang集合中包含自己。没有它,Google可能会忽略整个集群。 | 在德语页面上添加指向自身的 |
2 | 非双向(相互)标签 | 如果页面A指向页面B,页面B必须回指页面A。一个缺失的回指链接会破坏整个链条。 | 使用下面的hreflang审计agent——它会检查每对页面的双向性 |
3 | 无效的语言/地区代码 |
| 语言使用ISO 639-1( |
4 | 缺少 | 没有回退选项时,来自未列明地区的用户可能看到错误版本 | 始终添加 |
5 | Hreflang指向非canonical页面 | 如果 | 确保每个hreflang URL是页面的canonical版本 |
6 | Hreflang指向404或重定向 | 一个10语言站点中一个URL变更,就会产生最多20个破碎的hreflang引用 | hreflang审计agent会捕获跨语言版本的所有失效链接 |
7 | 跨语言canonical | 德语页面带有 | 每个语言版本的canonical必须指向其自身的URL |
8 | HTML lang不匹配 |
| 将 |

Hreflang审计Agent(自动化繁琐工作)
这是整套工具中投资回报率最高的agent。一个拥有5种语言、每种语言50页的网站,手动hreflang审计意味着检查250个页面——每个页面最多有5个hreflang标签,这些标签必须双向、自引用且无错误。agent可以在几分钟内完成。
---
name: hreflang-auditor
description: 爬取并审计整个多语言网站的hreflang实现——捕获失效链接、缺失回指标签、无效代码、canonical冲突等问题,并生成可直接修复的报告
---
# Hreflang审计Agent
爬取多语言网站,逐一审计每个hreflang标签是否符合Google要求。生成一份包含精确URL、错误类型和严重性评级的可修复报告。
## 前置条件
- 用户提供网站的基准URL(任何语言版本均可——agent将通过hreflang链接发现其他版本)
- 用户确认使用的是哪种URL结构(子目录、子域名或ccTLD)
- 无需API密钥——使用HTTP请求和HTML解析
## 输入
1. 网站基准URL(如`https://example.com/`或`https://example.com/de/`)
2. 已知语言代码(如果并非所有语言都可被发现)(如`["en", "de", "es", "fr", "ja"]`)
3. 可选:如果hreflang通过XML sitemap实现,提供sitemap URL
4. 可选:忽略列表——要跳过的URL模式(如`/tag/`、`/author/`、`/page/`)
## 工作流
### 阶段一:发现所有语言版本
- 爬取提供的基准URL
- 从HTML `<head>`中的`<link rel="alternate" hreflang="...">`标签提取所有hreflang链接
- 如果提供了XML sitemap,也从sitemap中提取hreflang集群
- 构建语言-页面矩阵:每个URL × 每种语言版本
### 阶段二:验证集群中的每个页面
对矩阵中的每个页面,检查以下8条规则:
1. **自引用:** 页面自身的hreflang值指向其自身的canonical URL
2. **双向性:** 对每一对(A→B),验证B→A存在
3. **有效代码:** 语言代码符合ISO 639-1;地区代码符合ISO 3166-1 Alpha-2
4. **x-default存在:** 集群中至少有一个页面设置了`hreflang="x-default"`
5. **Canonical对齐:** 每个hreflang URL均为canonical版本(非参数化或备用URL)
6. **HTTP状态:** 每个hreflang URL返回200(非301、302、404或500)
7. **无跨语言canonical:** 每个页面的canonical指向同一语言版本的URL
8. **HTML lang匹配:** `<html lang="...">`属性值与页面的hreflang值一致
### 阶段三:检查结构性问题
- **集群不一致:** 页面的hreflang标签集合与集群中其他页面的不一致
- **孤立页面:** 存在但未被任何hreflang集群引用的翻译页面
- **链式重定向:** 发生重定向(301/302)的hreflang URL——这些应直接指向最终URL
- **协议不匹配:** hreflang集合中存在HTTP与HTTPS不一致
### 阶段四:生成修复报告
对发现的每个问题,输出:
- 错误类型(来自上述8条规则)
- 严重性:**严重**(破坏整个集群)、**高**(可能导致显示错误页面)、**中**(合规性问题)、**低**(最佳实践偏差)
- 来源URL(发现错误的页面)
- 目标URL(有问题的hreflang链接)
- 修复说明:所需的确切代码或配置变更
### 阶段五:生成修正后的hreflang标签
对有可修复错误的集群:
- 输出每个页面修正后的`<link>`标签集
- 如适用,输出修正后的XML sitemap条目
- 标记无法自动修复的集群(例如,需先创建缺失页面)
## 输出
一份结构化的审计报告,包含:
1. 执行摘要:爬取的总页面数、发现的语言版本数、按严重性统计的错误数、整体健康评分(A–F)
2. 错误表格:每个错误的类型、严重性、来源URL、目标URL和修复说明
3. 逐一集群健康度:每个页面集群的每条规则通过/未通过状态
4. 自动生成的修复代码:每个破损页面的修正后hreflang标签
5. 优先级行动计划:应先修复哪些错误及其原因
## 局限性
- 仅爬取在已发现的hreflang集群中链接的页面;应该有hreflang标签但没有的页面不会被发现
- 无法在服务端修复页面——输出仅为建议性内容
- 对于JavaScript渲染的hreflang标签,原始HTML方式不适用——请改用XML sitemap方法
- 不检查每个语言版本的内容是否真的已翻译(请使用翻译质量agent来完成此项检查)步骤六:构建本地外链和内部链接结构
来自德国网站的外链有助于你的德语页面排名。来自日本网站的外链有助于你的日语页面排名。每个语言版本都在构建自己的权威性池。
多语言网站的内部链接规则
保持在同一种语言内。 德语博客文章应链接到其他德语页面,而非英语页面。跨语言内部链接会同时混淆用户和搜索引擎。使用hreflang标签——而非正文链接——来连接语言版本。
每页最少5条同语言内部链接。 每个翻译页面应至少接收来自同一语言中3-5个其他页面的链接。这可以防止孤立页面——这是网站翻译了内容但忘记翻译导航上下文时的常见问题。
一个URL变更会层层影响。 如果你在英文网站上变更了一个URL,而10种语言版本内部链接都指向它,那就是10个破碎链接。上面的hreflang审计agent会捕获这些问题——如果你在积极发布内容,建议每周运行一次。
每种语言的外部链接建设
你不需要为每种语言单独开展链接建设活动。从以下三种方式入手:
- 本地目录和评测平台: 每个国家都有自己的商业目录、评测网站和行业门户生态系统。认领你的档案。它们都是容易获得的链接,而且通常在本地排名不错。
- 竞争对手反链挖掘: 使用Ahrefs或Semrush获取每个目标国家排名第一的竞争对手的反链档案。筛选本地域名(
.de、.fr、.jp)。这些是最低垂的果实。 - 本地PR和客座投稿: 一篇发布在知名的本地刊物上的优质客座文章,价值超过50个低质量的目录链接。优先考虑质量而非数量——尤其是在链接竞争不那么拥挤的小市场。
步骤七:按语言追踪排名、流量和AI可见性
传统的SEO追踪(排名 + 自然流量)仍然必不可少。但在2026年,你还需要监测AI引擎是否在每种语言中引用你的内容。
传统追踪设置
- Google Search Console: 在Performance报告中使用Country筛选器。创建一个独立的property或使用International Targeting报告来查看hreflang特定的错误。
- GA4: 创建一个自定义报告,显示会话数、转化率和跳出率——按页面路径前缀(
/de/、/es/、/fr/)分割,以查看每种语言的表现。 - 排名追踪: Ahrefs、Semrush或SE Ranking——添加目标关键词并设置国家级追踪。第二波语言每月检查排名,优先级最高的市场每周检查。
AI可见性追踪(2026年的新内容)
对于AI回答呈现,按每种语言追踪以下三个指标:
- 引用存在性: 当有人在目标语言的ChatGPT、Perplexity或Gemini上询问你的品类相关问题时——你的品牌是否出现在回答中?按每种语言、每个平台,每月追踪你排名前10的关键词的"是/否"情况。
- 声量份额: 如果你的品类有5个品牌在西语AI Overviews中被引用,其中提到你的品牌的占比是多少?这就是你的SOV。
- 情感和准确性: 当AI引擎用另一种语言引用你的品牌时,信息是否准确?AI系统有时会跨语言混合内容——一个美国产品的声明可能出现在德语回答中,造成合规风险。
国际可见性监测Agent
---
name: international-visibility-monitor
description: 跨传统SERP和AI回答呈现追踪多语言搜索可见性——按语言和市场生成周度或月度可见性报告
---
# 国际可见性监测器
监测你的网站在不同语言的传统搜索和AI回答呈现中的表现。生成结构化报告,追踪每个市场的排名、流量和AI引用存在性。
## 前置条件
- Google Search Console访问权限(用户提供CSV导出或授予查看权限)
- GA4访问权限(用户提供按语言分割的流量CSV导出)
- 可选:Ahrefs/Semrush/DataForSEO API访问权限用于自动化排名追踪
- 手动数据导入无需API密钥
## 输入
1. 需要监测的目标语言和国家
2. 每种语言排名前10-20的关键词
3. GSC效果数据导出(CSV,按国家筛选)
4. GA4按语言的流量导出(CSV)
5. 可选:排名追踪API凭据
6. 上一期监测报告(用于趋势对比)
## 工作流
### 阶段一:收集传统搜索数据
- 解析GSC CSV:提取按国家和语言子目录划分的点击量、展示量、点击率和平均排名
- 解析GA4 CSV:提取按语言版本划分的会话数、转化率和互动率
- 如果排名追踪API可用:按国家拉取追踪关键词的当前排名
- 如果排名追踪API不可用:标注此情况并提供手动查询指南
### 阶段二:AI可见性检查(手动或自动化)
对每种目标语言及排名前5的关键词:
- 记录品牌是否出现在这些查询的Google AI Overviews中(从目标国家的Google域名搜索)
- 如果工具访问权限允许:对Perplexity和ChatGPT进行相同的查询检查
- 记录:是否被引用、被引用的URL、引用是否准确
- 注意任何跨语言污染(例如,英文URL被引用于西语查询)
### 阶段三:竞争对手可见性快照
对每个目标市场中排名前3的竞争对手:
- 记录在你们的共享关键词上的排名位置
- 检查在相同关键词上的AI Overviews引用存在性
- 标记月度可见性增减的竞争对手
### 阶段四:趋势分析
将当前数据与上一期对比:
- 每种语言的流量变化(%)
- 每个追踪关键词的排名变化(上升/下降的名次)
- AI引用存在性变化(新增引用、丢失的引用)
- 竞争对手动向(重大增减)
### 阶段五:生成报告
输出结构化可见性报告,包含:
1. **执行仪表盘:** 一个表格,包含所有语言及其关键指标(流量、平均排名、AI引用、趋势箭头)
2. **语言深度分析:** 每种语言的热门关键词分解、排名变化、AI可见性状态和竞争对手活动
3. **预警部分:** 需要立即注意的红旗项目——流量下降超过20%、丢失AI引用、GSC中发现hreflang错误、竞争对手在热门关键词上取得进展
4. **行动项目:** 基于发现结果的具体、优先级排序的任务(例如,"德语博客文章 'beste Laufschuhe' 排名第11位——优化并增加内部链接以推进至前10")
## 输出
一份结构化的监测报告,包含:
1. 多语言仪表盘(所有语言、关键指标、趋势箭头)
2. 每种语言的详细部分,包括关键词排名、AI引用和竞争对手快照
3. 红旗预警
4. 带预期影响的优先级行动项目
5. 数据新鲜度:每个数据来源的最后更新时间和数据缺失之处
## 局限性
- AI可见性检查是某一时刻的快照——AI回答变化频繁,相隔几分钟的查询可能得到不同结果
- 没有API的排名追踪需要手动查询;自动化排名数据依赖第三方API的可用性
- GSC和GA4数据存在固有延迟(GSC 24-48小时,GA4最多48小时)
- AI引用追踪是观察性的,而非穷尽的——目前没有任何工具能提供覆盖所有平台的完整AI引用数据多语言SEO Agent工具包:4个技能一览
以下是你可以在Claude Code中立即使用的四个agent技能总结。每个文件放入.claude/skills/<skill-name>/SKILL.md:
技能 | 功能 | 何时运行 | 节省时间 |
|---|---|---|---|
| 按需求、机会和业务匹配度对国家/语言打分 | 在开始任何翻译工作之前 | 3-5小时 |
| 生成本地化关键词列表,包含意图聚类和SERP验证 | 在新语言中创建内容之前 | 每种语言4-8小时 |
| 审计翻译页面的结构性问题、未翻译内容和术语一致性 | AI翻译后、发布之前 | 每批次2-4小时 |
| 爬取并验证每个hreflang标签是否符合Google的8项要求 | 上线前及之后每周 | 每次审计6-10小时 |
| 追踪每种语言的排名、流量和AI引用,附带趋势分析 | 每周或每月 | 每份报告3-5小时 |
安装任一技能: 从上述各节复制SKILL.md内容,保存到项目中的.claude/skills/<skill-name>/SKILL.md,然后在Claude Code中使用/skill-name运行。每个技能可以独立运作——如果你的网站已经是多语言的,从hreflang-auditor开始;如果你正在规划扩展,从multilingual-market-scorer开始。
初学者的上线前检查清单:上线前需验证的15件事
在发布任何新语言版本之前,使用以下清单:
- [ ] 目标市场基于数据(GA4 + GSC)选定,而非凭假设
- [ ] 每种语言的关键词研究已完成——排名前10的关键词已由母语者验证
- [ ] URL结构已选定(推荐初学者使用子目录)
- [ ] 没有基于IP的自动重定向——已改用语言选择器UI
- [ ] 所有页面提供真实的服务端渲染HTML(非客户端JS翻译)
- [ ] HTML
lang属性与每个页面的实际语言匹配 - [ ] Hreflang标签已实现(HTML、XML sitemap或HTTP headers)
- [ ] 每个页面上的自引用hreflang标签均存在
- [ ] 双向hreflang已验证——每个A→B都有B→A
- [ ]
x-defaulthreflang标签已设置为主要/回退页面 - [ ] 所有hreflang URL返回HTTP 200(无404,无重定向)
- [ ] 每个页面的meta标题和meta描述已翻译和本地化
- [ ] 图片alt文本已翻译
- [ ] 内部链接保持在同一种语言版本内
- [ ] Google Search Console International Targeting报告已检查——零hreflang错误
如果这15项全部检查通过,你就可以上线该语言版本了。
常见问题
我可以直接用Google Translate翻译我的网站吗?
不要直接发布Google Translate的原始输出。到了2026年,Google会将你的翻译与自己的机器翻译进行比较——如果你的翻译并不更优,它可能会展示其自动翻译的代理版本,而非你的页面。将AI翻译作为第一轮,然后运行翻译质量检查agent,再请母语者审核最高影响力的页面。
多语言SEO需要多长时间才能看到效果?
对于在已建立域名上新增的语言子目录,低竞争关键词预计2-4个月看到变化。成熟市场(德语、日语)的竞争性关键词可能需要6-12个月。域名已有的权威性有帮助——同一域名上的新语言版本会继承链接权重,这是选择子目录而非ccTLD的主要理由。
我需要为每种语言购买单独的域名吗?
不需要。对大多数网站而言,子目录(example.com/de/)是推荐方式。只有当你拥有当地办公室、当地法人实体,或在ccTLD是强力信任信号的市场运营时(德国、日本、法国),才使用ccTLD(example.de)。
如果我负担不起每个页面的专业翻译怎么办?
从每种语言排名前20的页面开始——也就是那些带动最多英语自然流量的页面。其余页面使用AI翻译配合质量检查agent。即使是高流量页面一个300字的原生语言版本,通常也能将Google的自动翻译代理版本排挤出去。质量重于数量:20个良好本地化的页面胜过200个糟糕翻译的页面。
在2026年,AI翻译会伤害我的SEO吗?
只要你遵循安全的工作流:AI第一轮翻译 → 自动化QA检查 → 高影响力页面的人工审核,就不会。Google已明确表示:"我们的政策并未严格界定AI翻译的内容为垃圾内容。"风险不在于使用AI——而在于未经审核就发布低质量的AI输出。
如何处理中文或阿拉伯语等使用不同文字或搜索引擎的语言?
对于中国市场,百度是主导搜索引擎,不支持hreflang。应改用Content-Language HTTP headers和百度的站长资源平台提交sitemap。中国大陆使用简体中文(zh-Hans),台湾和香港使用繁体中文(zh-Hant)。
对于阿拉伯语和其他RTL语言,确保你的CSS支持从右到左的布局。Google对SEO处理RTL内容没有问题,但破损的RTL布局会摧毁用户体验指标——而这些指标影响排名。
Claude Code真的能处理我所有的多语言SEO任务吗?
本指南中的agent技能负责处理那些让多语言SEO变得乏味的机械性、重复性工作:爬取数百个页面查找hreflang错误、将关键词翻译与SERP数据交叉对比、检查元数据和alt文本的翻译覆盖率、以及汇总可见性报告。它们不能替代的是:母语内容审核、战略市场决策、品牌信息的创意本地化,以及最终的编辑判断。使用agent来消除80%的繁琐劳动——然后把你的时间花在那需要人类专业知识的20%上。
每种语言最少需要多少页面?
从5-20个页面开始:首页、排名前3-5的产品/服务页面、关于页面、联系页面,以及流量最高的博客文章。这足以让Google将该语言版本识别为合法的。根据GSC的效果数据扩展——翻译那些已经在该语言中获得展示但点击率很低的页面。
作者:Dominic Hale,Auspia公司覆盖18个市场的国际SEO专家。Dominic为全球增长团队撰写关于多语言搜索策略、本地化工作流、hreflang架构和区域搜索行为的文章。












