GSC 如何按语言文件夹分开追踪

在 Google Search Console 的成效报表中,用「网页」筛选条件输入语言目录前缀(如「网址包含 /zh-hans/」),就能把繁体中文、简体中文、英文版本的曝光、点击与排名完全分开查看——这是子目录架构多语言站最重要的日常监控动作。 不分开看,你只会得到一锅混在一起、无法行动的平均值。

为什么多语言站不能看「全站平均」?

假设全站月曝光 100,000 次、平均点击率 2.5%。这个数字毫无诊断价值:可能繁体版点击率 4% 表现优异、简体版只有 0.8% 几乎全灭,两者平均后看起来「还行」。多语言站的每个语言版本都是独立的产品线,各自面对不同市场、不同竞争者,必须拆开追踪才能各自迭代。

基本操作:三步设定目录筛选

  1. 进入 GSC →「成效」→ 上方「+新增筛选器」→ 选「网页」。
  2. 条件选「包含网址」,输入 /zh-hans/(或 /zh-hant//en/)。
  3. 套用后,下方所有查询、网页、国家、设备数据都只剩该语言版本。

想更省事,可以把每个语言筛选后的报表网址加入书签,每周固定巡一轮三个语言。

四个必看的分语言报表

报表 1:语言 × 曝光趋势

分别套用三个目录筛选,比较 3 个月的曝光曲线。单一语言下滑、其他持平,代表问题出在该语言(内容、hreflang 或该市场的竞争),而不是全站技术问题。

报表 2:国家 × 目录交叉——揪出繁简蚕食

这是繁简站最关键的健检:筛选 /zh-hans/ 后切到「国家」分页,如果简体版在台湾拿到明显曝光(例如超过该版本曝光的 10–15%),代表 hreflang 分流失效,Google 正把简体页面送给台湾用户。反向检查繁体版在简体市场的曝光同理。

报表 3:语言 × 收录状况

搭配每语言一份的 sitemap(sitemap-zh-hans.xml 等),在「Sitemap」报表分别查看各语言的提交数与收录数。某个语言收录率特别低,常见原因依序是:内容与其他语言太相近(机器直转)、canonical 指错、内部链接太少。

报表 4:语言 × 查询字词

筛选 /zh-hans/ 后看「查询」分页:出现的字词应该是简体用词(软件、搜索、视频)。如果简体页面主要靠繁体查询拿曝光,代表该版本没有瞄准到自己市场的关键字,回头检查用词在地化。

进阶:正则表达式与资源分割

常见问题(FAQ)

Q1:子域名架构也能这样追踪吗? 子域名(tw.example.com)需要在网域层级资源下筛选,或为每个子域名建独立资源。这也是子目录架构的隐形优点之一:一个资源+目录筛选就能涵盖全部语言。

Q2:多久检查一次分语言数据? 建议节奏:每周扫一次三语言的曝光/点击趋势(5 分钟),每月做一次国家×目录交叉与收录率检查(30 分钟),每季配合内容负债稽核做完整健检。

Q3:发现繁简蚕食后该怎么处理? 第一步验证 hreflang(全语言+自我引用+x-default、双向一致),第二步检查 canonical 是否各自指向自己,第三步确认简体版内容有实质在地化差异。三者都修正后,观察 4–8 周的分流变化。

Q4:GSC 数据可以导出来做更细的分析吗? 可以。界面可导出 CSV,更完整的做法是接 Search Analytics API 或串接 Looker Studio,把「目录 × 国家 × 查询」做成固定仪表板,每月自动更新。


分语言追踪的前提是分流本身正确——hreflang 没配好,再漂亮的报表都是在测量一场混乱。用 GeoSeoToday 的 hreflang 生成器与 GEO 检测工具 先把标签做对,再回来建追踪仪表板。相关阅读:每种语言各一份 sitemap 怎么设、hreflang 常见错误导致繁简自我蚕食,完整方法论见支柱页《多语言 / 国际 SEO 完整指南》。