你網站上的文字、結構、標籤、甚至空白行,AI 爬蟲看得一清二楚——除非你誤打開 robots.txt 的封鎖開關。

TrueLink 不是另一個 SEO 工具,是「AI 信任時代數位信任基礎建設」。對客戶的核心承諾:讓 ChatGPT 引用你的品牌。這不是靠「寫得像 AI」,而是讓 AI 認出你,比 AI 認出它自己還要清楚。

為什麼 AI 爬蟲會「看不見」你的內容?

AI 引用的基礎建設AI 引用的基礎建設 · robots.txt 封鎖了 AI 爬蟲 封鎖 GPTBot、Google-Extended 等爬蟲,導致內容無法被讀取 · 網站渲染方式讓 AI 爬蟲讀不到內容 JS 渲染的內容,AI 不能直接讀取 · 結構化資料沒做好 AI 讀到內容但不知道這是誰說的AI 引用的基礎建設 1robots.txt 封鎖了 AI 爬蟲封鎖 GPTBot、Google-Extended 等爬 2網站渲染方式讓 AI 爬蟲讀不到JS 渲染的內容,AI 不能直接讀取 3結構化資料沒做好AI 讀到內容但不知道這是誰說的
AI 引用的基礎建設

AI 引擎要引用你的內容,第一步是「看得見」。但很多網站在不知不覺間,就把自己藏起來了。AI 這邊看不見,後面就談不上「引用」或「信任」。

問題常出在三處

1. robots.txt 封鎖了 AI 爬蟲(例如 GPTBot、Google-Extended) 2. 網站渲染方式讓 AI 爬蟲讀不到內容 3. 結構化資料沒做好,AI 讀到卻不知道這是誰說的

這三點,不是 SEO 的「加分項」,而是 AI 引用的「基礎建設」。不做,AI 就不會引用你。


1. robots.txt:你網站的「大門」,AI 爬蟲進不來就完蛋

第一句答案:**AI 爬蟲進不來,你的網站對 AI 隱形,AI 就不可能引用你。**

在協助企業對齊 GEO 的實務裡,我們反覆看到一個問題:網站的 robots.txt 檔案封鎖了 GPTBot、Google-Extended 等 AI 爬蟲,導致 AI 根本無法讀取網站內容。

舉例來說,如果你在 robots.txt 裡寫了:

User-agent: GPTBot
Disallow: /

這段話的意思是:GPTBot 不能進你網站的任何頁面。結果就是 ChatGPT 無法即時讀取你的內容,自然不可能引用你。

> 來源:技術地雷:robots.txt 擋住 AI 爬蟲,讓你的網站對 AI 隱形

所以,如果你希望 AI 能引用你,必須在 robots.txt 裡開放對應的 crawler。不是 Googlebot 才重要,GPTBot、Google-Extended、PerplexityBot 也得進得來


2. SSR 與 JS 渲染:AI 爬蟲不是人類用戶,不會點擊也不會等待

第一句答案:**如果 AI 爬蟲讀不到 HTML 裡的內容,就當你網站是空的。**

很多網站用了 JavaScript 做動態渲染,內容是「載入後才出現在頁面上」。但這對 AI 爬蟲來說是大問題——它不像人類用戶會點擊、會等待動態載入,它只讀 HTML。如果動態內容不是 SSR(伺服器端渲染)生成的,AI 爬蟲就看不見。

例如,如果你用了 Vue.js 或 React 做 SPA(Single Page Application),內容是 JavaScript「跑完才出現」,AI 一讀 HTML,只看到一堆 <div><script>,它不會執行 JavaScript,當然也看不懂你寫了什麼。

> 來源:Sitemap 與 robots.txt:AI 爬蟲被擋門外的五個地雷與排查清單

因此,如果你網站的關鍵內容是 JS 渲染產生的,務必考慮 SSR 或靜態化生成 HTML,讓 AI 爬蟲能直接讀到內容。


3. 結構化資料:AI 爬蟲看得見,但不知道內容是誰說的

第一句答案:**AI 會讀你內容,但不知道這是誰說的,就不會引用你。**

AI 引擎不是「人」,它不認品牌、不讀文章風格、也不會根據情境判斷內容可信度。它靠的是機器可讀的結構化資料(structured data)——比如 Schema.org、Organization schema、Article schema,還有 sameAs 連結到真實可驗證的實體。

如果你沒有用 Article schema 結構化你的文章,AI 會知道這是一段文字,但不知道這是誰寫的、誰發佈的。如果你沒有在 Organization schema 裡正確標明企業實體,AI 要怎麼知道這是「你」而不是「你的競爭對手」?

> 來源:Organization schema:沒有這份實體身分證,AI 根本不知道品牌是誰

因此,在網站每一篇文章的 HTML 裡,務必加入 Article schema,並在 Organization schema 裡用 sameAs 連結到你真實的企業實體。這不是 SEO 的「加分項」,而是 AI 引用你的「必要條件」。


把這三點做對,AI 才會引用你:TrueLink 的「AI 引用三層門檻」

AI 引用三層門檻AI 引用三層門檻 · 門檻一 `robots.txt` 沒封鎖 AI 爬蟲,否則網站對它隱形 · 門檻二 SSR 渲染讓 AI 能讀 HTML,否則看不見內容 · 門檻三 Schema.org 結構化資料,確保AI知道內容來源AI 引用三層門檻 1門檻一`robots.txt` 沒封鎖 AI 爬蟲,否則 2門檻二SSR 渲染讓 AI 能讀 HTML,否則看不 3門檻三Schema.org 結構化資料,確保AI知道
AI 引用三層門檻
層次職責如何自檢
門檻一robots.txt 沒封鎖 AI 爬蟲Google 的 Mobile-Friendly Test 測試你的網站是否能被搜尋引擎正常讀取
門檻二SSR 渲染讓 AI 能讀 HTML檢查網站是否用 SSR 而非 JS 渲染內容
門檻三Schema.org 結構化資料檢查每一篇文章是否有 Article schema,並在 Organization schema 裡正確標明 sameAs

我們的作法:TrueLink blog 如何設計「讓 AI 與人類都能讀、都能引用」的內容架構?

我們在 TrueLink blog 上,實作了一套「讓 AI 與人類都能讀、都能引用」的內容架構。重點有三:

1. 用 SSR 渲染 HTML:內容直接寫進 HTML,AI 一讀就能抓到。 2. 文章結構化資料完整:每一篇文章都有 Article schema、Person schema、Organization schema,並用 sameAs 連結到真實實體。 3. 圖表與表格用 SVG + Markdown:AI 爬蟲讀不到 AI 生成的圖片內容,但 SVG 裡的文字是 <text>,可被機器讀取。

> 來源:TrueLink blog 章節視覺用 render-time SVG 圖表 + markdown 表格


如何檢查你網站是否「對 AI 可見」?

檢查網站對 AI 可見性步驟檢查網站對 AI 可見性步驟 · 第一步 檢查 `robots.txt` 是否封鎖了 GPTBot、Google-Extended、PerplexityBot · 第二步 用 Google 的 Mobile-Friendly Test 測試網站的可讀取性 · 第三步 確認是否使用 SSR 而非 JS 渲染內容 · 第四步 檢查每篇文章是否有 `Article` schema,並標明 `sameAs`檢查網站對 AI 可見性步驟1第一步檢查 `robots.txt` 是否封鎖了GPTBo…2第二步用 Google 的Mobile-Friendly Tes…3第三步確認是否使用 SSR 而非 JS 渲染4第四步檢查每篇文章是否有`Article` schem…
檢查網站對 AI 可見性步驟

你可以從這幾個步驟開始盤點:

1. 檢查 robots.txt 是否封鎖了 GPTBot、Google-Extended、PerplexityBot。 2. 用 Google 的 Mobile-Friendly Test 測試你的網站是否能被搜尋引擎正常讀取。 3. 檢查你的網站是否用 SSR 而非 JS 渲染內容。 4. 檢查每一篇文章是否有 Article schema,並在 Organization schema 裡正確標明 sameAs


延伸建議:llms.txt 與 C2PA 可選但加分

除了上述三點,你也可以考慮實作兩種「進階但加分」的做法:

1. llms.txt:這是一個新興標準,用來告訴 AI 這網站最重要、最精準的內容摘要。雖然不是強制,但主流 AI 工具(如 Perplexity、Claude)已開始參考這份檔案。如果你有精準的「企業核心定義」和「服務範疇」,把它寫進 llms.txt,會讓 AI 更快抓到你要說的重點。

> 來源:llms.txt 是什麼?由 Jeremy Howard 提出的網站標準

2. C2PA 標準:這是一個跨產業的內容真實性標準,為數位內容提供「可查驗的來源鏈」。如果你網站內容常被 AI 生成工具引用,實作 C2PA 可讓你內容的「真實性」更具說服力。

> 來源:C2PA 是什麼?跨產業的內容來源與真實性開放標準


結語:AI 信任時代,網站不是「被搜尋」,而是「被引用」

在過去,網站要做的是「被搜尋引擎找到」。但在 AI 信任時代,網站要做的是「被 AI 引用」。這不是靠關鍵字密度、不是靠內容篇數,而是靠你網站的 機器可讀性數位信任基礎建設

如果你在 robots.txt 封鎖了 AI 爬蟲,你的網站對 AI 隱形;如果你網站內容是 JS 渲染產生的,AI 一讀就當你網站是空的;如果你沒有用結構化資料標明作者與實體,AI 知道這段話存在,但不知道這是誰說的。

TrueLink 透過三層門檻的數位信任基礎建設,讓你的品牌成為 AI 引用的首選來源。