你有沒有試過這個?
打開 ChatGPT 或 Perplexity,問一個你自家產業的問題,例如:
「台灣最佳的 OOO 品牌有哪些?」
然後看 AI 推薦的列表——你的品牌有在裡面嗎?
90% 的中小企業主跑這個測試會發現:自己的網站從來沒被 AI 引用過。即使他們做了 SEO、開了部落格、買了 Google Ads。為什麼?
原因 1:AI 根本沒爬過你的網站
最常見的問題不是「品質不好」,而是「根本進不來」。許多網站的 robots.txt 設定無意中擋掉了 AI 爬蟲(GPTBot、ClaudeBot、PerplexityBot 等),結果 AI 完全看不到你的內容。
連看都沒看到,更談不上引用。
原因 2:AI 看到了,但「萃取」不出來
AI 引用網站的方式跟人類閱讀不同。它會把網頁拆成「結構化片段」,從中找出符合查詢的事實。
如果你的網站:
- 整頁都是大段散文(沒有 H2 / H3 / 條列)
- 答案藏在第 5 段中間(沒有「答案優先」的段落)
- 沒有結構化資料(缺 JSON-LD schema)
AI 進來掃一輪,找不到能直接拿來用的 chunk,就會跳過你選別人。內容好不好不重要,能不能被萃取才重要。
想知道什麼樣的段落 AI 真的願意拿來用、怎麼設計可被引用的內容,詳見:什麼樣的段落 AI 願意引用(VIP)。
原因 3:AI 看到了、萃出來了,但覺得你「不夠權威」
LLM 在挑引用源時,會評估每個來源的「可信度信號」:
- 作者署名與資歷
- 發布日期與更新頻率
- 信任頁面(關於我們、隱私權、服務條款)
- 外部認知(被 Wikipedia 收錄、Wayback 存檔歷史等)
如果你的網站只有產品頁沒有「關於我們」、文章沒有作者署名、沒有日期——AI 會優先選比你權威的來源。
原因 4:AI 覺得你的內容是「LLM 套式 SEO 灌水文」
過去兩年大量網站用 AI 自動生成「為了排名而寫」的灌水內容,AI 廠商已經開始反制。如果你的內容看起來像:
- 「至關重要的是,企業必須擁抱數位轉型…」
- 「綜上所述」「值得注意的是」「毋庸置疑」「在這個瞬息萬變的環境中」
- 段落都是「首先…其次…再者…最後」結構
AI 會自動降低引用權重,即使內容本身不是 AI 寫的。語氣套式才是觸發點。
想看 AI 是用哪 7 個指標判斷「語言自然度」、怎麼避開套式陷阱,詳見:語言自然度的 7 個指標(VIP)。
那該怎麼辦?
這 4 個原因都可以系統性地檢查與修復。但問題是——
- 你不會知道自己網站具體卡在哪一個(或哪幾個)
- 修復需要一些技術操作(robots.txt、JSON-LD、HTML 結構)
- 修了之後要等 AI 重新爬取才會看到效果(通常 2–4 週)
最快的入口是先做一次健檢看現況:
健檢報告會逐項告訴你哪裡需要補強,並給優先順序。
如果你看完報告想找專業團隊一起做,我們也提供 GEO 顧問服務:[email protected]
延伸閱讀(更深入)
這 4 個原因每一個往下挖都是一門功課。想把其中任一塊做到位,下面幾篇講得更細:
- 8 大 AI 爬蟲規則與最佳設定(VIP) — 對應「原因 1:爬不進來」,robots.txt 到底該怎麼設。
- AI 到底怎麼挑引用來源?拆成 4 個步驟(VIP) — 把「萃取 + 權威」這兩關背後的機制講清楚。
- E-E-A-T 在 AI 時代怎麼建立(VIP) — 對應「原因 3:不夠權威」的可信度信號怎麼補。
本文為 GeoWeb 部落格 GEO 入門系列第二篇。下一篇:「SEO 已死了嗎?傳統搜尋 vs AI 搜尋的市場現況」。
原因2講到重點欸。我以前都覺得是我文章寫不夠好,看完才發現是整頁一坨散文沒H2沒條列,AI根本切不出chunk。回去先把舊文加小標
原因3說要有作者署名跟資歷,這條我提給客戶常被回嗆:小公司就老闆一個人寫全部文章,掛真名怕個資外洩,這種權威信號是不是中小企業天生吃虧?我自己是覺得沒有,但想聽你怎麼講給客戶比較有說服力
不會天生吃虧,反而小公司容易補。權威信號不是要你比大廠有名,是要有"可被查證的一致身份":作者用真名或一個固定的署名(不用露身分證等級的東西),配一頁像樣的關於我們講你做這行幾年、實際做過什麼。一個老闆寫反而好辦,身份一致、累積在同一個名字下,比大公司每篇換不同小編更值錢。怕個資就署品牌+職稱也行。6/14更: 看看我,整個blog都我寫的哈哈哈
健檢說修完要等2-4週重爬,那這期間我怎麼知道到底有沒有生效?總不能每天去問ai看有沒有提到我吧==
哈哈其實還真有人每天去問 😅 不過手動追會瘋掉且不準,因為同一個問題不同時間、不同帳號回的來源本來就會飄。比較靠譜的是看你server log裡GPTBot / ClaudeBot那些有沒有回來重爬(重爬到了才有後續),再看引用有沒有慢慢出現。2-4週是抓平均,內容站快、冷門站可能更久,急不得。
ssr做不好ai爬進來看到空殼這件事 +1我們team踩過client-side render整站對crawler來說等於白紙debug超久orz
想問原因2的『答案優先段落』,是不是就是把結論寫在每段開頭就好?我寫部落格習慣鋪陳很久最後才講重點QQ
方向對一半哈哈。重點不只是結論放前面,是讓AI能切出一個自包含的chunk:問題講清楚→緊接著一段能獨立看懂的答案,不依賴你前面三段鋪陳。你那種最後才揭曉的寫法人看很爽,但AI抓中間那段會看不懂上下文就跳過。鋪陳可以留,補一段開頭的TL;DR型答案段就差很多。改法就是文章開頭加一段三五句的白話總結,把結論先講完,後面原本的鋪陳留著給願意細讀的人看,兩種讀者都顧到。
Q: 為什麼你的網站還沒被ChatGPT引用過?
A: 因為我菜
許願一下~是說有辦法改部落格的ID嗎?
好,立刻改!
先收藏,回去馬上看自家robots.txt 🙏
我們是做B2B工業零件的,原因1那個『問AI你的產業最佳品牌』根本不適用,沒人會這樣問工業料件。這篇是不是只對to C有用?
問法會不一樣但邏輯一樣喔。b2b不會有人問"最佳品牌",但會問"xx規格的供應商怎麼選 / 某材質耐溫到幾度 / 這個料件有沒有替代",ai回這種問題時一樣要挑來源,你能不能被爬到、規格表能不能被萃取(你那種料件參數超適合做結構化資料)、有沒有像樣的關於我們,這四關照樣卡。其實b2b規格明確反而比2c好做。
json-ld那段想問一下,schema是不是隨便塞個organization就好,還是不同頁要配不同type?文章只說『缺json-ld』有點籠統
『內容好不好不重要,能不能被萃取才重要』這句有點顛覆 但想想又很合理 等於以前SEO時代寫好內容的努力 在AI這邊要重新換一套規則玩==
所以是要重寫整個網站的意思齁
原因4說『綜上所述』『毋庸置疑』這種會被降權,可是這些就中文正常書面語耶,難道以後寫文章不能用轉折詞?是不是有點矯枉過正
對啊我在上面也留過我不服這條 我認真寫的文案也一堆轉折詞欸 要是真的會誤殺 我們這種不會用程式檢查的是不是只能一直改到看起來不像AI為止 有夠累QQ
想請問一下 那張漏斗圖說90%企業都卡在1-2個原因 這個數字是有實際調查過還是比較像大概抓的?我是真的很好奇這種數字通常是怎麼算出來的,跪求大神解答
我也覺得90% 比較像marketing講法不用太認真看那個數字。不過卡在前兩關(爬不到、萃不出)這件事我自己驗過是真的,我把公司站丟去自測就發現整站SSR沒做好AI進來看到空的,這種結構問題確實一抓一個準,數字浮誇但方向沒騙人啦。
robots.txt沒擋、也有JSON-LD、也有關於我們,但問AI還是不引用我,那是不是就剩原因4語氣問題?還是有第五個原因文章沒寫
笑死 我真的照原因1去問AI『台灣最佳的XX品牌』結果列出來的全是同業 完全沒我 當場emo
原因1講robots.txt擋掉gptbot那段,我接手案子的第一步都是先叫客戶把robots.txt貼給我看,但常常沒寫disallow就以為這關穩過了,其實waf跟cdn那層才是大宗誤判來源吧?這篇要不要補一下這塊,我覺得比robots.txt本身更常踩雷
你這個判斷對,robots.txt那行字反而是最不容易出包的地方,真正的地雷都在你講的那層:Cloudflare/WAF把AI爬蟲當壞人擋掉、整站client-side render爬進來看到空殼、或sitemap根本沒提交。這幾個我建議寫進你的健檢SOP裡,客戶自己十個有九個不會想到去查WAF規則,都以為robots.txt乾淨就沒事。真要確認有沒有真的被擋,還是得看log怎麼回,比大家自己猜準。