多語言/國際 SEO 完整指南:hreflang、架構與在地化

多語言 SEO 的成敗取決於四件事:正確的 hreflang 標註、合理的網站架構(子目錄優先)、每個語言各自做關鍵字研究,以及在地化而非機器翻譯。本指南整理從技術實作到內容策略的完整流程。

背景:多語言站為什麼容易做壞

多語言 SEO 是技術債最容易累積的領域,因為錯誤是隱形的:hreflang 標錯不會有任何警告,只會讓繁中使用者搜到簡中頁、讓兩個語言版本互相蠶食排名。更麻煩的是,2026 年多了一層考量——AI 引擎(ChatGPT、Perplexity)回答繁中問題時引用哪個語言版本,同樣取決於你的語言標註與各版本的內容品質。

好消息是:多語言 SEO 的技術部分是有限集合——需要做對的事情就那幾件,做對一次之後邊際成本極低。真正的長期投入在內容端:每個語言市場的關鍵字研究與在地化寫作。所以本指南把技術模組放在前面一次講完,讓你把省下的心力全部投到內容上。

本指南按施工順序分五個模組:hreflang → 架構 → sitemap 與追蹤 → 繁簡分治 → 在地化與關鍵字。

模組 1:hreflang——多語言站的地基

hreflang 告訴搜尋引擎「這一頁有哪些語言/地區版本」,讓每個使用者被導向正確版本。三個實作載體擇一:HTML head、HTTP header 或 sitemap。基本形式:

<link rel="alternate" hreflang="zh-Hant" href="https://example.com/zh-hant/page/" />
<link rel="alternate" hreflang="zh-Hans" href="https://example.com/zh-hans/page/" />
<link rel="alternate" hreflang="en" href="https://example.com/en/page/" />
<link rel="alternate" hreflang="x-default" href="https://example.com/en/page/" />

三條鐵律:

  1. 雙向互指:A 標了 B,B 必須也標 A,缺一邊整組失效。
  2. 自我引用:每頁要標自己。
  3. 指向最終網址:不能指向轉址或 canonical 到別處的頁面。

基礎教學見〈hreflang 是什麼?多語言站必備教學〉。最容易出事的場景是繁簡互相蠶食——用了 zh 而不是 zh-Hant/zh-Hans 是頭號元兇,完整錯誤清單見〈hreflang 常見錯誤導致繁簡自我蠶食〉。至於 x-default 該指向哪個語言(答案:給「不匹配任何標註語言」的使用者看的版本,通常是英文或語言選擇頁),見〈x-default 要指到哪個語言〉。

如果不想手寫,可以用工具直接產生正確標籤組,用法見〈一鍵產生正確 hreflang 標籤〉。

模組 2:網站架構——子目錄、子網域還是 ccTLD

三種架構的取捨:

架構 範例 優點 缺點
子目錄 example.com/zh-hant/ 權重集中、維護最省 地區訊號較弱
子網域 zh.example.com 部署彈性 權重部分分散
ccTLD example.tw 地區訊號最強 每個域名從零養、成本最高

大多數網站的正確答案是子目錄:所有語言共享同一個網域的權威,新語言上線第一天就有底子。只有明確深耕單一國家市場、且有預算獨立經營時才考慮 ccTLD。完整決策分析見〈多語言站架構:子目錄 vs 子網域 vs ccTLD〉。

模組 3:sitemap 與 GSC——讓每個語言可量測

架構定了之後,做兩件配套:

沒有這兩件配套,你的多語言站就是一個黑箱:總流量在動,但你不知道是哪個語言在動。

模組 4:繁中 vs 簡中——不是字轉換那麼簡單

繁簡是華文站最特殊的課題。兩者不是同一語言的兩種編碼,而是兩個不同的搜尋市場

正確做法是把 zh-Hant 與 zh-Hans 當成兩個獨立市場:各自做關鍵字研究、各自在地化寫作、hreflang 精確標到 script 層級。完整對比見〈繁中 vs 簡中 SEO:不是字轉換那麼簡單〉。

模組 5:在地化與多語言關鍵字研究

技術做對只是及格,內容決定上限。兩個原則:

  1. 在地化 ≠ 翻譯:機器翻譯再通順,也翻不出當地的搜尋習慣、範例與文化脈絡。Google 對「純機器翻譯的規模化頁面」的態度等同低品質規模化內容。該全文在地化還是輕度翻譯,取決於頁面的商業價值,決策框架見〈在地化 vs 翻譯:為什麼不能只丟機器翻譯〉。
  2. 關鍵字研究每個語言各做一次:不要把繁中關鍵字清單翻譯成英文清單——兩個市場搜尋的問題本身就不同。方法見〈多語言關鍵字研究:各語言各自做〉。

最後,把常見的坑一次掃過:自動依 IP 強制轉址、hreflang 與 canonical 打架、語言切換器擋爬蟲、只翻內文不翻 meta——8 個高頻錯誤的完整清單見〈國際 SEO 常見錯誤 8 個〉。

上線前檢查清單:多語言站的 12 個必查項

把五個模組收斂成一張發布前的檢核表,每個語言版本上線前逐項打勾:

  1. hreflang 三鐵律:雙向互指、自我引用、指向最終網址。
  2. 語言代碼精確到 script:zh-Hantzh-Hans,不是裸的 zh
  3. x-default 已設定且指向合理的預設版本。
  4. 每個語言各有一份 sitemap,並列入 sitemap index。
  5. GSC 已為每個語言目錄建立獨立資源。
  6. 沒有依 IP 自動強制轉址(Googlebot 大多從美國來,強制轉址等於讓它永遠看不到其他語言)。
  7. canonical 指向自己,沒有跨語言 canonical。
  8. title、meta description、圖片 alt 都已在地化,不是只翻內文。
  9. 語言切換器是真實的 <a href> 連結,爬蟲可循線發現所有版本。
  10. 未在地化完成的機翻頁已 noindex。
  11. 各語言的目標關鍵字來自該語言的獨立研究,不是翻譯清單。
  12. 每個語言版本的重點頁面都跑過就緒度評分,達 75 分。

這 12 項裡,第 1、2、6 三項是事故率最高的:它們單獨任何一項出錯,都足以讓整個多語言配置形同虛設。建議把這張清單做成上線流程的一部分:每次新增語言或大改版都完整跑一遍,並在上線後兩週回 GSC 確認新版本的索引曲線正常爬升——多語言的技術錯誤幾乎都是在「上線當下沒檢查、三個月後看報表才發現」的情境裡釀成大損失的。

加映:多語言 GEO——讓 AI 用各語言引用你

2026 年做多語言站還有一個新戰場:生成式引擎。AI 回答繁中問題時傾向引用繁中來源——如果你的繁中版只是英文版的機翻,AI 會跳過你去引用寫得更道地的對手。多語言 GEO 的做法(每個語言版本各自達到可引用標準),見〈多語言網站的 GEO〉。

學習路線圖:這個群集怎麼讀

第一次做多語言站,建議照這個順序消化本站的群集文章:

多語言 SEO 的本質是乘法:技術配置 × 內容品質 × 每個語言的市場理解。任何一項是零,整個語言版本就是零——這也是為什麼「先做好一個語言再擴張」永遠是最穩的路線。

擴張新語言時,建議套用「70 分複製法」:不要企圖第一天就把新語言做到與主語言同等規模,而是先挑主語言表現最好的 20% 頁面(用 GSC 點擊數排序),將這批頁面完整在地化並配齊 hreflang 與獨立 sitemap,觀察 2–3 個月的索引與流量表現,確認技術管線通了、市場有反應,再逐步擴充其餘內容。這個做法把新語言的試錯成本壓到最低——如果連最強的 20% 頁面在新市場都沒有反應,問題就出在市場選擇而不是執行,及早止損比硬撐全站在地化划算得多。

常見問題(FAQ)

Q1:先做幾個語言比較好? 先把 1 個語言做到有機流量穩定,再擴第 2 個。同時開 5 個語言的結果通常是 5 個都做一半——多語言的成本不在翻譯,在每個語言的持續維護。

Q2:hreflang 做錯會被懲罰嗎? 不會被懲罰,但會失效——Google 直接忽略錯誤的標註,然後用自己的判斷分配版本,結果往往就是繁簡蠶食。是「白做」而不是「扣分」。

Q3:小網站需要 ccTLD 嗎? 幾乎不需要。子目錄架構讓所有語言共享網域權威,對資源有限的網站是壓倒性的正確選擇。

Q4:機器翻譯的頁面該不該擋索引? 未經人工在地化的機翻頁建議先 noindex,等在地化完成再開放——大量低品質機翻頁被索引,會拖累全站的品質評估。

Q5:多語言站的成效怎麼驗收? 分語言看三組數字:GSC 各語言資料夾的曝光與點擊、各語言 sitemap 的索引率、以及各語言版本被 AI 引擎引用的情況。


要快速產生正確的 hreflang 標籤組,用 GeoSeoToday多語言 SEO 服務頁內建的 hreflang 產生器;各語言版本的內容夠不夠格被 AI 引用,則交給 GEO 就緒度檢測器——貼上文章,30 秒拿到 0–100 分與逐項修正建議。