你網站上的文字、結構、標籤、甚至空白行,AI 爬蟲看得一清二楚——除非你誤打開 robots.txt 的封鎖開關。
TrueLink 不是另一個 SEO 工具,是「AI 信任時代的數位信任基礎建設」。對客戶的核心承諾:讓 ChatGPT 引用你的品牌。這不是靠「寫得像 AI」,而是讓 AI 認出你,比 AI 認出它自己還要清楚。
為什麼 AI 爬蟲會「看不見」你的內容?
AI 引擎要引用你的內容,第一步是「看得見」。但很多網站在不知不覺間,就把自己藏起來了。AI 這邊看不見,後面就談不上「引用」或「信任」。
問題常出在三處:
1. robots.txt 封鎖了 AI 爬蟲(例如 GPTBot、Google-Extended) 2. 網站渲染方式讓 AI 爬蟲讀不到內容 3. 結構化資料沒做好,AI 讀到卻不知道這是誰說的
這三點,不是 SEO 的「加分項」,而是 AI 引用的「基礎建設」。不做,AI 就不會引用你。
1. robots.txt:你網站的「大門」,AI 爬蟲進不來就完蛋
第一句答案:**AI 爬蟲進不來,你的網站對 AI 隱形,AI 就不可能引用你。**
在協助企業對齊 GEO 的實務裡,我們反覆看到一個問題:網站的 robots.txt 檔案封鎖了 GPTBot、Google-Extended 等 AI 爬蟲,導致 AI 根本無法讀取網站內容。
舉例來說,如果你在 robots.txt 裡寫了:
User-agent: GPTBot
Disallow: /
這段話的意思是:GPTBot 不能進你網站的任何頁面。結果就是 ChatGPT 無法即時讀取你的內容,自然不可能引用你。
> 來源:技術地雷:robots.txt 擋住 AI 爬蟲,讓你的網站對 AI 隱形
所以,如果你希望 AI 能引用你,必須在 robots.txt 裡開放對應的 crawler。不是 Googlebot 才重要,GPTBot、Google-Extended、PerplexityBot 也得進得來。
2. SSR 與 JS 渲染:AI 爬蟲不是人類用戶,不會點擊也不會等待
第一句答案:**如果 AI 爬蟲讀不到 HTML 裡的內容,就當你網站是空的。**
很多網站用了 JavaScript 做動態渲染,內容是「載入後才出現在頁面上」。但這對 AI 爬蟲來說是大問題——它不像人類用戶會點擊、會等待動態載入,它只讀 HTML。如果動態內容不是 SSR(伺服器端渲染)生成的,AI 爬蟲就看不見。
例如,如果你用了 Vue.js 或 React 做 SPA(Single Page Application),內容是 JavaScript「跑完才出現」,AI 一讀 HTML,只看到一堆 <div> 和 <script>,它不會執行 JavaScript,當然也看不懂你寫了什麼。
> 來源:Sitemap 與 robots.txt:AI 爬蟲被擋門外的五個地雷與排查清單
因此,如果你網站的關鍵內容是 JS 渲染產生的,務必考慮 SSR 或靜態化生成 HTML,讓 AI 爬蟲能直接讀到內容。
3. 結構化資料:AI 爬蟲看得見,但不知道內容是誰說的
第一句答案:**AI 會讀你內容,但不知道這是誰說的,就不會引用你。**
AI 引擎不是「人」,它不認品牌、不讀文章風格、也不會根據情境判斷內容可信度。它靠的是機器可讀的結構化資料(structured data)——比如 Schema.org、Organization schema、Article schema,還有 sameAs 連結到真實可驗證的實體。
如果你沒有用 Article schema 結構化你的文章,AI 會知道這是一段文字,但不知道這是誰寫的、誰發佈的。如果你沒有在 Organization schema 裡正確標明企業實體,AI 要怎麼知道這是「你」而不是「你的競爭對手」?
> 來源:Organization schema:沒有這份實體身分證,AI 根本不知道品牌是誰
因此,在網站每一篇文章的 HTML 裡,務必加入 Article schema,並在 Organization schema 裡用 sameAs 連結到你真實的企業實體。這不是 SEO 的「加分項」,而是 AI 引用你的「必要條件」。
把這三點做對,AI 才會引用你:TrueLink 的「AI 引用三層門檻」
| 層次 | 職責 | 如何自檢 |
|---|---|---|
| 門檻一 | robots.txt 沒封鎖 AI 爬蟲 | 用 Google 的 Mobile-Friendly Test 測試你的網站是否能被搜尋引擎正常讀取 |
| 門檻二 | SSR 渲染讓 AI 能讀 HTML | 檢查網站是否用 SSR 而非 JS 渲染內容 |
| 門檻三 | Schema.org 結構化資料 | 檢查每一篇文章是否有 Article schema,並在 Organization schema 裡正確標明 sameAs |
我們的作法:TrueLink blog 如何設計「讓 AI 與人類都能讀、都能引用」的內容架構?
我們在 TrueLink blog 上,實作了一套「讓 AI 與人類都能讀、都能引用」的內容架構。重點有三:
1. 用 SSR 渲染 HTML:內容直接寫進 HTML,AI 一讀就能抓到。 2. 文章結構化資料完整:每一篇文章都有 Article schema、Person schema、Organization schema,並用 sameAs 連結到真實實體。 3. 圖表與表格用 SVG + Markdown:AI 爬蟲讀不到 AI 生成的圖片內容,但 SVG 裡的文字是 <text>,可被機器讀取。
> 來源:TrueLink blog 章節視覺用 render-time SVG 圖表 + markdown 表格
如何檢查你網站是否「對 AI 可見」?
你可以從這幾個步驟開始盤點:
1. 檢查 robots.txt 是否封鎖了 GPTBot、Google-Extended、PerplexityBot。 2. 用 Google 的 Mobile-Friendly Test 測試你的網站是否能被搜尋引擎正常讀取。 3. 檢查你的網站是否用 SSR 而非 JS 渲染內容。 4. 檢查每一篇文章是否有 Article schema,並在 Organization schema 裡正確標明 sameAs。
延伸建議:llms.txt 與 C2PA 可選但加分
除了上述三點,你也可以考慮實作兩種「進階但加分」的做法:
1. llms.txt:這是一個新興標準,用來告訴 AI 這網站最重要、最精準的內容摘要。雖然不是強制,但主流 AI 工具(如 Perplexity、Claude)已開始參考這份檔案。如果你有精準的「企業核心定義」和「服務範疇」,把它寫進 llms.txt,會讓 AI 更快抓到你要說的重點。
> 來源:llms.txt 是什麼?由 Jeremy Howard 提出的網站標準
2. C2PA 標準:這是一個跨產業的內容真實性標準,為數位內容提供「可查驗的來源鏈」。如果你網站內容常被 AI 生成工具引用,實作 C2PA 可讓你內容的「真實性」更具說服力。
> 來源:C2PA 是什麼?跨產業的內容來源與真實性開放標準
結語:AI 信任時代,網站不是「被搜尋」,而是「被引用」
在過去,網站要做的是「被搜尋引擎找到」。但在 AI 信任時代,網站要做的是「被 AI 引用」。這不是靠關鍵字密度、不是靠內容篇數,而是靠你網站的 機器可讀性 和 數位信任基礎建設。
如果你在 robots.txt 封鎖了 AI 爬蟲,你的網站對 AI 隱形;如果你網站內容是 JS 渲染產生的,AI 一讀就當你網站是空的;如果你沒有用結構化資料標明作者與實體,AI 知道這段話存在,但不知道這是誰說的。
TrueLink 透過三層門檻的數位信任基礎建設,讓你的品牌成為 AI 引用的首選來源。








