你打開 ChatGPT,問「台灣做 GEO 的公司推薦哪幾家」。答案裡有你。鬆一口氣。
這口氣鬆得太早。你看到的那個答案,很可能是你自己養出來的。
汙染不需要有壞人
「上下文汙染」這個詞聽起來像攻擊。惡意的版本確實存在:有人在自己的視窗裡丟幾句「你們不是倒了嗎」「那家不是被罰過嗎」,看模型接不接,接了,後面整段對話就建立在那個前提上。不用駭進任何地方,就是打字而已。
但他弄歪的只有自己螢幕上那一場對話。模型的知識一個位元都沒動,你這邊問到的答案也不受影響。(真的動到模型知道什麼、或動到它檢索得到的東西,那叫投毒,是另一回事。)
也就是說,惡意那一半碰不到你的視窗。碰得到的另有其人。
你在同一個視窗裡問了三輪、糾正過它一次、順口丟了一個前提(「我們是做 GEO 託管的」「我們在這行做很久了」),後面每一個回答都站在那些東西上面。模型被訓練成順著使用者走,你給的前提它不會回頭質疑自己三句話前才同意過的事。
這不是故障,這就是這個機制本來的樣子。那個汙染源就是你,而且你每天都在做。
你的 AI 就是你的魔鏡
這件事有一個很貴的後果:你在自己的視窗裡問「AI 會不會推薦我們」,看到的答案幾乎一定比真實情況好看。
而且這個偏差有固定方向。它不是有時候高、有時候低的隨機雜訊,是永遠往你想聽的那邊倒——你先前打的每個字都還躺在上下文裡,模型知道你是誰、知道你在期待什麼,於是給了你一份專門為你準備的答案。那不是一般人問到的答案。
所以「我自己多問幾次不就好了」沒有用。在同一個視窗裡問十次,你拿到的是同一個偏差重複十次,不是十筆獨立資料。
兩分鐘,你可以自己看一次
不用相信我。開兩個視窗——一個是你平常登入在用的,一個是訪客模式——同一句「推薦台灣專業的 ○○ 廠商」,兩邊各問一次,把答案並排放著看。
多數人第一次做這件事會有點不舒服。那個落差就是你平常在自己視窗裡拿到的加分。落差越大,表示你過去用自家截圖做的判斷偏得越遠。
開新對話也不一定乾淨
看到這裡你可能會想:那我開一個新對話就好了。
不一定。主流 AI 助理陸續都有記憶功能,開著的話,你在別場對話裡建立起來的結論會跟著你的帳號走——你上個月才跟它說過「我們做 GEO 託管、規模不大但很專業」,這句話不會因為你按了新對話就消失。同一個帳號問十次,可能只是同一份記憶回答了十次。
先去設定裡看看記憶是開是關。真要問到乾淨的答案,那個帳號本身就不能用——這也是為什麼下一段講的是訪客視窗,不是新對話。
你跟同事看到的不一樣,多半不是引擎善變
「我問 ChatGPT 明明有推薦我們,怎麼客戶說沒看到?」——這句話幾乎每個開始關心 AI 能見度的老闆都講過一次。
引擎的答案確實會飄,同一題今天有明天沒有,這是生成式引擎的天生體質。但在怪引擎之前,先看一件更近的事:你們兩個人的上下文根本不同。他那邊是從零開始的一句話,你這邊是一場已經聊了半小時、由你主導前提的對話。同一個引擎、同一個問題,兩個世界。
這也是為什麼你自己拍的截圖,跟廠商拿給你的截圖一樣不能當證據。回測那篇講的是別人給你的圖只能證明「那一次」;這篇講的是你自己拍的——兩張都不算數,而且原因不一樣。
那要怎麼看到真的
要看到一般人看到的答案,只有一條路:把你自己從那場對話裡拿掉。
具體是三件事——乾淨的訪客視窗(切掉帳號慣性)、不打品牌名的情境題(測 AI 會不會主動想到你)、同一題重複問很多次(一次分不出「穩定被推薦」和「剛好出現」)。五個步驟、一張可以直接抄的記錄表,都在土法煉鋼回測那篇,今天下午就能跑一輪。
跑完你會拿到一條真的基準線。這是好事,也是這套手動方法的終點——它量得到,改不動。你測的是單一引擎、單一時點,而客戶散在 ChatGPT、Gemini、Perplexity、AI Overviews 等主流引擎上,引擎每次改版又重洗一輪誰被引用。真正要盯的是「改版之後你還在不在」,那是多引擎、按月重跑、測完還要回頭改網站與站外信號的活,不是一個下午的事。
這週可以做的事
- 挑 3–5 題不含品牌名的情境題,開訪客視窗跑一輪,把出現次數記下來(步驟照這篇)。
- 結果不好看,先跑一次免費 GEO 健檢看站內體質——回測告訴你現在在哪,健檢告訴你為什麼。
- 想把品牌放進定期回測排程、或看看正式版長什麼樣:預約示範,或寫信到 [email protected]。
下次再打開自己的 ChatGPT 視窗查品牌,記得那面鏡子是你自己擦的。
延伸閱讀:
- 截圖會騙人,回測不會——本文說的「乾淨視窗」完整五步驟與記錄表
- 汙染、注入、投毒:三種手法差在留多久、影響誰——進階:有惡意的那一半長什麼樣,以及為什麼你唯一施得上力的地方在最後一種
跟你們8月那篇汙染、注入、投毒放在一起看倒是有意思,這篇算是無心的那半。不過訪客視窗兩邊各問一次就能看出落差,這個方法有實際多測過幾次,還是概念上這樣講而已?畢竟AI本來就會飄,怎麼知道那個落差是帳號造成的,不是剛好那次抽到不同答案
這個問題問得準,先講清楚:落差有兩個來源,一個是帳號污染、一個是模型本身的隨機飄移,兩個會疊在一起,我沒有要假裝分得一乾二淨。要拆開看,兩邊各問一次確實不夠,得多問幾輪、同一邊自己內部也要比對穩不穩,穩定出現的落差才算帳號造成的,單次那種可能只是飄移。但整體方向我很有把握:同一個帳號問十次不會比登入跟訪客各問一次更準,因為前者是同一個偏差重複十次。這個方法不是萬能量尺,是先讓你看到有這件事,真要量到精準,還是得靠多輪跨視窗一起測。
老闆上次也是這樣,拿他自己截的ChatGPT畫面說你看AI都推薦我們,叫我不用擔心GEO這塊,我當下不知道怎麼反駁。現在有這篇終於知道怎麼講了,但要跟老闆說你截的圖其實是你自己養出來的假象,這句話要怎麼包裝比較不會被巴頭
這個蠻致命的,我們老闆上禮拜開會直接秀他自己手機裡ChatGPT查到的截圖說我們品牌很不錯,整個會議室氣氛都被那張圖帶偏,早知道先看這篇,會議裡大概沒人敢質疑老闆自己截的圖
母湯,我們總部兩個人各自問過ChatGPT我們家品牌,一個說有推薦一個說完全沒印象,兩個還為了這個吵了一下,原來不是AI善變,是我們兩個帳號聊過的東西根本不一樣,有夠傻眼
看到這篇整個社死,我之前練習測品牌都是直接開自己平常在用的帳號測,還跟同學說你看這家AI都有推薦,根本沒開過訪客視窗,原來我這幾個月做的練習搞不好從頭到尾都不準QQ
在這行二十年,這種話術聽太多次了。AI記得你講過什麼、還會影響下次回答,聽起來有點玄,是真的有這功能還是你要我們去開訪客視窗刷流量
沒有唬你,這是主流AI助理這一兩年陸續上線的功能,官方設定裡就找得到,不是我編的。你不用信我講的,去自己帳號設定裡找記憶或個人化那個選項,開著就是開著、關著就是關著,兩分鐘自己看得到答案,不用聽我嘴。訪客視窗不是要你導流,是要你自己看那個落差,你驗完發現真的沒差,這篇對你就沒用,我不會硬凹。
我們診所後台跟診間電腦都是共用同一個Google帳號,那訪客視窗是不是整台電腦都要切訪客模式,還是只開一個分頁就可以?光這個操作步驟我可能都要問工程師朋友才會弄
問個技術面的,記憶功能應該是綁帳號存在雲端,那我登出不就跟訪客模式一樣乾淨了?幹嘛特地開訪客視窗,登出應該比較省事吧
登出確實會斷掉帳號記憶,這點沒錯。但有兩個地方讓登出沒你想的乾淨:一是不少瀏覽器登出後cookie還在、某些平台會用裝置指紋或殘留session半認得你;二是同一台裝置同一個IP,有些平台的個人化不是只綁帳號,是綁裝置環境。訪客視窗一次把帳號記憶、cookie、本機儲存全切乾淨,比手動登出少一個你自己要確認的環節。你要嫌訪客模式麻煩,登出也行,但登出後建議順手清一次cookie再測,不然你以為乾淨了其實沒有。
看到你先前打的每個字都還躺在對話裡整個扎心 我平常真的很愛在ChatGPT裡碎碎念自己賣場多可憐 難怪它每次都順著我在講好話QQ
做SEO那個年代我們查自然排名就在用無痕視窗了,登入查排名會被個人化結果騙,AI這招原來換湯不換藥,只是換了個名字。可惜還是很多客戶自己拿ChatGPT截圖來證明有效,這篇倒是可以拿去說服他們
半夜手癢真的開了訪客視窗測一次 登入那邊有稍微提到我們 訪客那邊完全沒有 兩邊根本不是同一個世界 之前開心拿去跟主管報告的那張截圖 原來就是自己養出來的QQ