如何被 Claude 引用為答案來源:Anthropic 的取材偏好

要被 Claude 引用,靠的不是關鍵字堆疊,而是「事實密度」加「明確作者實體」。Claude 偏好結構清晰、每個主張都可驗證、且不誇大的來源;當它用網頁檢索工具即時抓資料時,會優先挑能直接摘錄、來歷清楚的段落。 內容寫得像廣告、主張沒有數據支撐,就進不了它的引用池。

Claude 是 Anthropic 開發的 AI 助理。它引用外部網站,主要發生在啟用「網頁搜尋」的情境——例如 Claude.ai 開啟聯網、或透過 API 使用 web_searchweb_fetch 這兩個伺服器端工具時。這時 Claude 會即時檢索、抓取網頁,挑出最能回答問題的來源,並在答案裡標注引用。要被選中,你的頁面要通過三道關卡:抓得到、可驗證、值得引。以下逐一拆解。

第一步:確認 Anthropic 的爬蟲抓得到你

Anthropic 的爬蟲分兩類用途,混為一談是常見錯誤,設定時要分開處理:

User-agent 用途 擋掉的後果
ClaudeBot 收集模型訓練資料 未來版本的模型「腦中」沒有你
anthropic-ai 早期訓練抓取代理 同上,屬訓練用途
Claude-User / Claude-SearchBot 支援聯網回答的即時檢索抓取 Claude 聯網回答永遠引用不到你

這裡的關鍵取捨:訓練爬蟲與檢索爬蟲要分別決定。 如果你不希望內容被用於訓練,可以只擋 ClaudeBot;但只要擋掉即時檢索的 Claude-User,就等於放棄被 Claude 聯網回答引用的機會。很多網站用「一鍵擋 AI 爬蟲」的外掛或 CDN 設定(例如 Cloudflare 的 AI bot 封鎖)把兩者一起擋掉,自己都不知道。

檢查步驟:

  1. 打開 robots.txt,確認沒有對上表的 user-agent 下 Disallow
  2. 確認 CDN/防火牆沒有對這些 bot 回 403(robots.txt 放行、但 CDN 擋下,是最隱蔽的失敗)。
  3. 重要內容不要全靠 JavaScript 渲染後才出現——檢索爬蟲對 JS 的處理有限,正文要在 HTML 原始碼就讀得到。
  4. 用伺服器 log 確認這些 user-agent 真的有來訪。

user-agent 字串會隨時間調整,Anthropic 也會新增或更名爬蟲。實務做法是定期查官方文件,並在 log 裡以 Claudeanthropic 為關鍵字比對,而非只信一份靜態清單。

第二步:把每個主張寫成「可驗證」的內容

這是 Claude 取材偏好和其他引擎差異最大的地方。Anthropic 自家給開發者的文件裡,反覆強調要用「明確、可驗證、有結構」的內容,而不是含糊的行銷語言——這套偏好同樣反映在 Claude 挑選引用來源時。

Claude 的檢索工具(Anthropic 的 web_search 新版本)具備「動態過濾」:它會即時寫程式把檢索結果先篩過一輪,再送進模型判讀。這意味著模糊、無數據、公關腔的段落更容易在這一關被淘汰——不是因為你缺內容,而是因為缺可信度訊號。要提高存活率:

寫法 錯誤示範 正確示範
有數據 「效果非常好」 「GEO 論文實測,可見度最多提升 40%」
可溯源 「業界普遍認為」 「Google 官方文件(Search Central)明確說明」
不誇大 「保證第一名」 「多數情況提高機率,但無官方保證」
有結構 一大坨純文字 定義句、比較表、編號步驟
敢寫限制 通篇只講優點 「此法在 X 情況不適用」

最後一項「敢寫限制與取捨」尤其重要:Anthropic 訓練 Claude 時重視誠實與校準,一篇坦承邊界的文章,比通篇吹捧更像可信來源。這也是為什麼本文一路標明「無官方保證」「字串會變動」——這正是 Claude 偏好的語氣。

第三步:建立明確的作者實體

Claude 在多個來源之間挑選時,偏向「來歷清楚」的頁面。你要留下機器讀得到的實體訊號:

  1. 明確的作者與品牌:頁面有作者名、品牌名,且全站一致。匿名的泛泛內容最難被信任。
  2. Schema 結構化資料:至少加上 Article 與 FAQPage schema,讓模型明確知道誰、何時、講什麼。作者頁再補 Person schema 與 sameAs 串接社群。
  3. 明確日期:標明發布與更新日期。2026 年的查詢,模型明顯偏好近期更新、且是實質改版(非只改日期)的來源。
  4. 主題群集:單篇孤文難以建立權威;同主題寫 10 篇以上互相連結,實體權威才會成形。

事實密度加明確作者實體——這兩件事合起來,就是「可驗證」的具體樣貌,也是進入 Claude 引用池的門票。

被 Claude 引用的六項檢查清單

發佈前逐項對照:

  1. robots.txt 沒有擋掉 Claude-User / Claude-SearchBot
  2. CDN/防火牆沒有對這些 bot 回 403。
  3. 正文在 HTML 原始碼可讀,不依賴 JS 渲染。
  4. 文章第一段就用 40–80 字給出可摘錄的自包含答案。
  5. 每個關鍵主張都有數據或可點開的來源,語氣不誇大、敢寫限制。
  6. 有明確作者、品牌、發布/更新日期與 Article+FAQPage schema。

常見問題(FAQ)

Q1:Claude 有像 ChatGPT Search 那樣的即時引用嗎? 有,但要在啟用聯網/網頁搜尋工具時才會即時檢索並引用外部網頁。純靠模型內部知識回答時不會附即時來源;被訓練資料涵蓋(ClaudeBot 抓取)與被即時檢索引用(Claude-User 抓取)是兩條不同的路。

Q2:只擋 ClaudeBot、放行 Claude-User 可以嗎? 可以,而且是常見的折衷:不讓內容進訓練集,但保留被 Claude 聯網回答即時引用的機會。反過來把兩者一起擋掉,是最常見、最可惜的失誤。

Q3:關鍵字密度對被 Claude 引用有幫助嗎? 幫助很小,甚至反效果。Claude 的檢索過濾偏好事實密度與可信度訊號,不是關鍵字重複次數。把力氣放在數據、來源、清楚實體上,比堆關鍵字有效得多。

Q4:內容用英文寫會比較容易被 Claude 引用嗎? 對英文查詢是;但繁體中文查詢時,Claude 傾向引用中文原生來源。做台灣市場就用台灣用語把繁中內容寫紮實,這反而是競爭較低的機會。

Q5:被引用了卻沒有連結點擊,有意義嗎? 有。品牌在 AI 答案中反覆出現,累積的是品牌搜尋量與信任——這本身就是強力的權威訊號,會回頭推升整體 SEO 與其他引擎的引用機率。


想知道你的文章夠不夠格被 Claude 引用?GeoSeoToday 把上述檢查邏輯做成了免費的 GEO 就緒度檢測器,貼上文章 30 秒拿到 0–100 分。Claude 看重的「可驗證、明確作者」其實就是 E-E-A-T 的機器可讀版本,想深入請讀〈E-E-A-T 是什麼?2026 怎麼做到〉;若你的目標引擎是 ChatGPT,另見〈如何讓 ChatGPT 引用你的網站內容〉。