「文章要寫夠長,AI 才會覺得你有料。」
這句話從 SEO 時代一路帶過來,現在被原封不動搬到 GEO 上,順便撐起了一整個「內容代寫,每篇保證三千字」的市場。它是錯的,而且有一份規模夠大的資料可以直接把它否掉。
那份研究測的是位置,不是有沒有被引用
先把口徑講死,因為這個數字在中文圈已經被講歪好幾輪了。
Ahrefs 分析了 56 萬則 AI 總覽、從中抓出 167 萬個被引用的網址,再過濾成 17.4 萬個能成功取出內容的頁面。他們算的是:字數跟這一頁在 AI 總覽引用清單裡排第幾,兩者的 Spearman 相關係數是 0.04。
0.04 是統計上的零。把它翻成白話:一篇一千字和一篇五千字的文章同時在回答同一個問題,字數幾乎不影響誰會被排在前面。
但要注意它測的是引用位置,不是「有沒有被引用」。網路上很多轉述直接寫成「字數跟被引用無關」,那多跨了一步。這份資料能支持的結論是:在已經進入候選的頁面裡,長度不會讓你排得更前面。
這個限制不影響結論的實用性,因為下一個數字更直接。
被引用的頁面,一半以上不到一千字
同一份資料裡:53.4% 被 AI 總覽引用的頁面在一千字以下,只有 16% 超過兩千字。
也就是說,AI 引用來源的長度分布,跟「內容要長」這個信念是反過來的。短頁面不但沒被排除,還是多數。
這其實不難理解。AI 引用的時候不是把整篇讀完再決定要不要推薦你,它是從你的頁面切出一段放進答案裡。切得出來就有機會,切不出來寫十萬字也沒用。長度在這個過程裡沒有位置,它影響的是切之前那一關——頁面要進得了模型的上下文,太長反而是負擔。
有關係的是標題之間放多少字
同一份研究還測了另一件事:兩個標題之間的字數。
結果是標題之間放 120 到 180 字的頁面,比只放不到 50 字的頁面多拿到約 70% 的 ChatGPT 引用。
這個數字比 0.04 有用得多,因為它可以直接執行。它在講的是:一個小標底下要有足夠的內容自成一段完整的說明,但不能長到讓人(和模型)找不到重點。
太短的問題是資訊不完整——AI 切了那一塊出來,發現裡面只有一句宣稱,沒有條件、沒有數字、沒有依據,於是它去切別人的。太長的問題是稀釋——一個小標下面塞了八百字,模型不知道要切哪一段,最後整塊跳過。
跟「段落 40 到 80 字」怎麼搭
我們之前寫過的可引用段落設計建議單一段落控制在 40 到 80 字。這跟上面那個 120–180 是不同層級的東西,不要混用:
- 40–80 字講的是一個段落,也就是 AI 實際切出去的那個單位
- 120–180 字講的是兩個小標之間,也就是那個單位所在的區塊
兩者剛好套得起來:一個小標底下放兩到三個 40–80 字的段落,加起來就落在 120–180 的區間。這不是巧合,是同一件事的兩個尺度——切得出來的段落,要待在一個大小適中的區塊裡才容易被找到。
實作上大概長這樣:小標帶資訊(不要寫「更深層的原因」這種),底下第一段直接回答小標問的事,第二段補條件、數字或例外,第三段收在一個可以獨立讀懂的結論。三段之後換小標。
所以該砍什麼
如果你手上有一批為了湊字數而生的內容,優先砍這幾種:
- 前情提要。第二節開頭那句「如同我們在前面提到的」,對從搜尋進來的讀者和從中間切走一段的 AI 都是雜訊。
- 同義反覆。同一個意思用三種說法講一遍,這在 SEO 時代是關鍵字密度,現在只是稀釋。
- 每節結尾的小結。整篇「總—分—總、節節有小結」的對稱結構本身就是模板訊號,而且小結通常是把上一段換句話說。
- 抽象名詞排比。「更快速、更精準、更全面」佔了字數卻沒有任何可切出來的事實。
砍完之後如果篇幅掉一半,那不是損失。精簡不是把內容寫淺——密度變高,切出來的每一段都帶著事實和條件,這才是可引用的樣子。
難的不是砍,是知道砍完有沒有用
上面這幾條你今天就可以動手,一篇文章一個小時改得完。
比較麻煩的是後面那一段:改完之後怎麼知道有效?排名不會動,流量也未必馬上變,你唯一能看的是「AI 回答相關問題的時候,有沒有開始切你這一段」。這要一輪一輪去問、記錄哪幾題引用了你、引用的是哪一段,而且因為 AI 的回答本來就有隨機性,單次結果不能當證據。
一篇文章改完,這個回圈要跑好幾週才看得出東西;整站幾十篇一起改,那是另一個量級的工作。
想知道你現在的內容切不切得出來,我們可以先幫你看一次。
延伸閱讀
- 可引用段落怎麼設計 — 40–80 字那一層的完整寫法
- LLM 引用偏好的內容特徵 — 除了長度以外,模型還在看什麼
- 常見的 GEO 迷思 — 其他從 SEO 時代帶過來、現在已經不成立的信念
老闆上週才說我們官網文章太短要我補到三千字,我現在拿這篇去跟他講。賭他會回「那是國外的研究」XD
QQ 我賣場的商品描述都是一大段寫到底,根本沒有小標那種東西,那是不是整個都切不出來啊
可是商品頁加標題很醜欸 而且平台版型也不給我自由排orz
ㄏㄏ 所以砍小結、砍前情提要、砍排比,最後結論還是你自己量不出來有沒有效、要找人固定跑,套路還是那個套路
不過這篇至少沒硬塞數字,口徑也標清楚了,這點還行
想幫長文講一句話。
文章講的是「被引用」這件事,但長文在品牌端還有別的功能:業務拿去給客戶看、內部對齊說法、記者寫報導時當背景資料。這些不會因為AI不切它就沒價值。
我知道文章沒說長文有害,只說長度換不到引用。但實務上很多人會直接讀成「內容不用寫深」,這中間的差別其實可以講得更明白一點。
口徑要看清楚。0.04是Spearman,而且測的是citation position不是has_citation,文章自己有寫這點算誠實。
但這樣的話「長度不影響會不會被引用」其實沒被證明,只證明了進shortlist之後排序跟長度無關。這兩件事在實務上差很多——前者才是大家想知道的。
切得很準,那段的限定是刻意寫的,就是不想多跨那一步。
補一個研究沒回答的部分:我們手上跑過的站,長度跟「有沒有被引用」的關聯也很弱,但那是實務樣本、量級不夠成論證,所以我沒寫進文章。
你要自己驗證的話有個做法:挑一組你自己的頁面,主題同一群但字數差三倍以上,拿同一批問題去問,看被切走的是哪幾段。通常會發現切走的都是同一種形狀的段落,跟整篇多長沒什麼關係。
結論我不改:把資源押在長度上是錯的配置。
拿我們媒體站套一下:這研究應該是英文語料吧,那120-180這個區間中文要怎麼換算?
中文一個字承載的資訊跟一個英文word差蠻多的。我們編輯台照這個抓的話,是抓120-180個中文字,還是換算成英文word數再回推?這中間差快一倍欸
這題文章沒處理,是個缺口,謝謝你點出來。
原研究是英文語料,120-180指的是word count。中文沒有對等的公開數字,我也不想憑空換算一個給你——中文一個字承載的資訊比一個英文word少,但中文不用空格跟冠詞,這兩邊互相抵銷多少,沒有人真的量過。
我們自己編輯台是抓中文200-300字當一個小標區塊,那是經驗值不是研究結論,你要參考可以,別當定律用。真正可靠的判準還是那一句:那一塊單獨拿出來,讀得懂嗎。讀得懂就夠了。
又來了== 上次我在12維那篇就問過可引用性要40-60字、FAQ又說20-100字,現在這篇又多兩個數字40-80跟120-180。我們這種不懂技術的真的會瘋掉,可不可以直接給一個數字就好啦
不是標準不一致,是這幾個數字在量三個不同的東西——這點我們沒在文章裡講明白,是我們的問題。
40-60字是FAQ那種一問一答的答案長度;40-80字是一個段落;120-180字是一個小標底下全部段落加起來。所以它們是套在一起的,不是互相打架。
你診所的頁面其實不用拿尺量。一個小標配兩三段,每段講完一件事就換行,整塊唸出來一口氣唸不完就是太長了。用唸的比用數的準。
母湯 我們外包的內容約就是一篇三千字算一篇,現在看完不就等於我一直在付錢買稀釋==
回去要跟廠商重談,但他八成會說那就改成一千字算一篇、寫三篇給你 笑死
笑死 你們廠商真的會這樣講。我們之前也是按字數計價,後來改成按篇算,結果每篇都剛好卡在最低標XD
先收藏 我上週才被廠商報價一篇三千字 看完有點想取消==
哈 我之前在另一篇問過長文是不是把重點塞開頭就好 這篇等於回答我了。
不過我要幫字數說一句公道話:0.04是在講排序位置,不是說長文沒價值。做這行十幾年,當年關鍵字密度2%也被當鐵律講了好幾年,最後發現那是相關不是因果。這次別又走一次同樣的路,變成大家改去追120-180這個數字。