為什麼 FAQ 在 GEO 中地位這麼高?
打開 ChatGPT 問任何「What is X」「How to X」「Why X」開頭的問題,回答結構大概率是:
「X 是 …(一句答案)。它的特點是 …(補充)。常見應用場景包括 …(列舉)。」
這個結構正好對應 FAQ 的 Q&A 微結構——一個問題 → 一句答案 → 補充。LLM 在訓練時大量讀過 FAQPage schema 標記過的內容,把這個格式「內化」成輸出範本之一。
直接結論:含 FAQPage 結構的網站,在問答型查詢上的引用率遠高於純散文型網站。
GeoWeb 的「FAQ/Q&A 就緒度」維度(8% 權重)有 5 個檢查點,下面逐項拆。
檢查點 1:FAQPage Schema 是否存在且有效
檢查內容
- 頁面是否含
<script type="application/ld+json">區塊 - 區塊內
@type是否為FAQPage - 是否含
mainEntity陣列 - 每個元素是否含
Question與acceptedAnswer
為什麼重要
沒有 FAQPage schema 的 FAQ 內容,LLM 解析時得靠 H2/H3 結構推測。準確率約 60–70%——很多 FAQ 會被誤解為一般文章。
有 FAQPage schema = 親口告訴 LLM「這是 Q&A 結構」。準確率近 100%。
常見錯誤
- Schema 內容跟頁面 visible Q&A 不一致(LLM 偵測到此後會懲罰整站)
acceptedAnswer.text含 HTML 標籤但沒 escape- 多個 Q 但只有一個 A(schema 結構錯)
檢查點 2:可見問答內容(visible Q&A)
檢查內容
- 頁面 HTML 中是否實際有 Q&A 結構(不是只在 schema 裡)
- 每個 Question 有對應的可見答案文字
- Q 與 A 之間語意一致(schema 與 visible 對齊)
為什麼重要
很多網站把 FAQPage schema 當「裝飾」——schema 有,但頁面實際看到的是普通段落。LLM 進來解析時發現 schema 與內容不對稱,整個 schema 失效。
更嚴重的:LLM 廠商會把這類網站標記為「schema spam」,影響整站信任度。
檢查點 3:答案長度(20–100 字最佳)
檢查內容
每個答案的字數分布:
- < 10 字:太短,AI 萃取後語意不完整
- 20–100 字:黃金長度——AI 可整段引用
-
200 字:AI 切 chunk 時會切斷,引用變斷頭
為什麼重要
AI 在 reranking 時會對「長度合理」的答案加分。20–100 字剛好是「能完整回答 + 不浪費 token」的甜蜜點。
常見錯誤
- 為了 SEO 把答案灌到 500 字(反而傷 GEO)
- 一句話 5 字答案(沒實質訊息)
- 答案塞滿關鍵字(語言自然度被降權)
檢查點 4:問題多樣性與覆蓋面
檢查內容
- 問題類型分布(What / How / Why / When / Who / Which)
- 問題之間語意是否獨立(不重複)
- 是否覆蓋使用者真實搜尋的問句變體
為什麼重要
LLM 在語料中對「多樣化問題」的網站偏好更高——這通常代表「真實 Q&A」(vs 自家編出的 FAQ for SEO)。
如果你的 FAQ 全是「為什麼 X 是最好的選擇」「如何選擇 X」「X 的優勢」——LLM 會偵測到這是「行銷話術型 FAQ」,不是真實使用者問句。
怎麼產生多樣化問題
- 從客服訊息撈真實問題
- 從 Google 「People Also Ask」抓
- 從 Reddit / Dcard / PTT 相關討論串看真實口吻
檢查點 5:視覺呈現(accordion vs 直接展開)
檢查內容
- FAQ 是否用
<details>/ Bootstrap accordion / aria-expanded 等可摺疊元件 - 摺疊的內容是否在 initial HTML 中(vs JS lazy load)
為什麼重要
SEO / GEO 的 best practice 是「摺疊呈現給人類,但內容必須在 HTML 中」:
- 人類使用者:摺疊 UI 不擠
- AI 爬蟲:能在初始 HTML 看到所有 Q&A
反例:某些網站用 JS 動態載入 FAQ,初始 HTML 沒內容。AI 爬蟲沒跑 JS = 看不到 Q&A = FAQ 完全失效。
GeoWeb 的 parser 在 M3-7 修復過一個 bug:以前對 Bootstrap 5 accordion 偵測不到,導致誤判客戶網站「沒 FAQ」。修好後客戶分數從 0 跳到 55——同樣的內容、同樣的 schema、只是偵測邏輯對了。
健檢報告會看到什麼
「FAQ/Q&A 就緒度」維度會逐項列出:
- ✅/❌ FAQPage schema 是否存在 + 是否有效
- ✅/❌ 是否有可見 Q&A 結構(含 accordion 偵測)
- 答案長度分布(黃金 vs 過短 vs 過長 各幾筆)
- Q&A 數量與問題類型多樣性
- schema 與 visible 內容一致性
如果你的網站需要從零建立 FAQ 結構(含真實問句蒐集、schema 部署、accordion UI),我們提供 GEO 顧問服務含完整內容架構規劃:[email protected]
GEO 深度系列 #14。前一篇:「IndexNow 協議是什麼?什麼網站值得啟用?」
想問檢查點3的20-100字 是中文字數還是英文word count? 中文100字跟英文100 words差超多的吧,這邊講得有點含糊
推一個,不過想補充:文章只講FAQPage,其實QAPage schema也是一種,適合那種一問多答(像論壇)的情境,跟FAQPage的一問一答不一樣,別搞混了
對這個補充很實用 👍 FAQPage是官方自己一問一答、QAPage是使用者提問可多人回答(論壇/QA社群那種)。一般企業官網用FAQPage就對了,硬套QAPage反而可能跟你頁面實際結構不符,又踩到文章講的schema跟visible不一致那個雷。
認真問 文章說沒FAQPage schema靠H2/H3推測準確率約60-70% 有schema近100% 這數字是你們自己測的還是有來源? 想知道怎麼算出來的
答案分數從0跳到55這段...同樣內容同樣schema只是偵測邏輯對了 講真的這比較像是在講你們parser以前有bug不算客戶網站變好欸 ㄏㄏ
做電商的補充一下,我們的FAQ多樣性那項一直被扣分,後來去翻客服LINE的對話真的撈出一堆我們自己想不到的問句 像是運費怎麼算 過年出貨嗎 這種 跟自己編的完全不同個世界
M3-7那個Bootstrap 5 accordion偵測不到的bug我笑出來,我們家網站就是用bootstrap accordion做FAQ的,難怪之前掃出來FAQ那欄一直是叉叉==
看到一半以為是教學 看到結尾免費健檢+顧問服務 喔原來是業配 不過寫得比一般業配用心啦給推
12維度系列追到第14篇了 這篇faq算寫得最實用的一篇 其他維度什麼時候出
檢查點5說M3-7修好之後客戶分數從0跳到55,那剩下的45是卡在哪?是不是5項裡其他幾項沒過
對,就是其他幾項沒過 哈哈。那個案例偵測到FAQ後schema跟visible是OK的所以拿到基本分,但答案長度一堆超過200字、問題又全是自家編的行銷題,多樣性跟長度兩項直接扣。所以55比較像是終於被看見了的起點分,不是終點。偵測對了只是讓後面四項有機會被評。
檢查點2講schema跟visible不一致會被當schema spam然後懲罰整站 這個有點可怕 想問是不是只要不一致整站就GG還是只有那頁?
問題多樣性那段說全是『為什麼X是最好的選擇』『X的優勢』會被判定行銷話術型FAQ,可是老闆就是要我寫這種帶推銷的問句啊,難道完全不能放?
不是完全不能放,是不能全部都是這種 哈哈。比例的問題,你放兩三題偏推銷的沒事,但整頁十題都是"為什麼我們最好",語意太集中,主流ai引擎就會把它歸到行銷話術那一類。穿插what/how/when那種中性問句去稀釋,真實問句佔多數就好,老闆的推銷題還是塞得進去。
<details>那段學到了,原來重點不是摺疊本身是內容要在initial HTML裡,我之前還傻傻把整個FAQ做成API call回來render orz
問題多樣性那段點到Reddit/Dcard/PTT撈真實口吻 但台灣很多冷門B2B產業根本沒人在論壇討論 這種要去哪生多樣化問句?
檢查點1說schema跟visible不一致llm偵測到會懲罰整站,但我們cms的faq schema是外掛自動產的,跟頁面手改的內容常常對不上,這種情況很常見吧?你們健檢能抓出是哪幾題對不上嗎?
超常見,外掛自動產schema跟人手改內容對不上幾乎是CMS網站的通病 😅 健檢這項會逐題列出哪幾筆schema文字跟visible文字對不起來,不是只給你一個整站紅燈。順帶一提外掛產的schema要特別注意它有沒有把你後來刪掉的舊題也留在json-ld裡,這種幽靈題也算不一致。
工程師角度追問一下,文章說AI爬蟲沒跑JS就看不到JS lazy load的FAQ=完全失效,那這個「不跑JS」是所有主流引擎的crawler都這樣,還是有的會跑有的不會,要看是哪一隻在抓?
Google的Googlebot確實會render JS沒錯,但這篇講的是GEO不是傳統SEO。GEO面對的那些AI引擎/retrieval的crawler很多是輕量抓取,根本不等你JS跑完,有些直接拿raw HTML就走。所以結論還是成立:內容塞在initial HTML最保險,你不會知道是哪隻crawler來抓。
schema裡acceptedAnswer.text含HTML沒escape這個雷我踩過 整段json-ld直接parse error然後rich result test紅一片
想問一下,如果我的faq答案大部分都超過200字(因為產品很複雜不得不解釋很多),照文章說會被切chunk切到斷頭,那是不是只能硬拆成多題短答? 還是有別的解法
硬拆通常是最乾淨的解 一個大問題其實往往藏了2-3個小問題,拆開來每題20-100字反而更好被引用。如果真的某題拆不開(像規格表那種),可以前面放一句20-100字的直球答案當摘要,後面再接長段細節,主流AI引擎抓前面那句的機率高很多。你的產品線就照這個邏輯配:能拆的問題硬拆、拆不開的規格表加一句摘要在前面,兩種情況都有解,不用糾結哪種產品該用哪招。
免費健檢做完FAQ這維度只有8%權重,感覺佔比不高,值得花這麼多力氣優化嗎?還是先顧其他高權重的維度比較划算
8%在12個維度裡不算最高沒錯,但FAQ的CP值很怪,它是少數補一次內容就能同時吃到問答型查詢引用的維度,而且問答型查詢量很大。我自己的看法是:如果你網站連個FAQPage都沒有,這8%是最快補起來的;但如果你FAQ已經有了只是想從55調到90,那確實先去顧schema覆蓋率那種大塊的更划算。看你現在站在哪個階段。