是什麼

8 月 2 日,歐盟 AI 法案第 50 條的透明度義務正式適用,同一天有兩件事上路:做模型的那一端要把生成出來的東西標記成機器可辨識;發布內容的那一端——也就是你——在某些情況下要主動揭露這段文字是 AI 產的。

技術面在上路前一個月就談攏了。7 月 24 日 Google 簽署歐盟的「AI 生成內容透明度行為準則」,並把自家的 SynthID 浮水印拉著 Apple、OpenAI、NVIDIA、ElevenLabs、Kakao 一起做成可互通的規格。準則講白了就兩個機制:簽章式中繼資料(掛在檔案上,像圖片的出生證明)跟看不見的浮水印(直接編進內容本身)。

文字那一塊的細節這幾天也公開了。Anthropic 的說明文件直接把 8 月 2 日當成觸發點,寫得很具體:新模型從上線第一天起,會在生成的文字裡織進人眼看不出來的浮水印,複製貼上會跟著跑,輕度編輯之後可能還在;圖檔(.png、.jpg、.svg)則另外掛 C2PA 簽章。它同時老實列了兩個限制——測不到不代表不是 AI 寫的(文字太短、改寫過、轉過格式都可能讓訊號消失),測得到也不代表那家是原作者(拿去翻譯或摘要別人的東西,一樣會帶上)。至於一般人到底怎麼驗,官方說偵測方式之後才會出技術文件。

跟你有什麼關係

先把最容易誤會的一件事拆掉:這些標記是為了法規上的可辨識性而做,公開文件裡沒有一句話把它跟搜尋排名綁在一起。 沒有哪個引擎會因為你的文章帶了浮水印就把排名往下壓。

但別把這句話讀成「所以沒事」。「排名不掉」跟「AI 還認得你」是兩件事,後面那件才是這篇真正要講的。

會咬到你的是另一條。第 50 條第 4 項規定,當你把 AI 生成的文字拿去向公眾提供公共利益相關的資訊時,必須揭露它是 AI 生成或竄改的。看到這裡先別急著在每篇文章頂上加一行「本文由 AI 生成」——這一項附了豁免條款,而那個條款才是整件事的重心:

內容若經過人工審查或編輯把關,且有自然人或法人對該內容的發布負編輯責任,則不適用揭露義務。

法規等於拿一條線把內容產線切成兩半。一邊是 AI 產完直接發,你得掛牌告訴讀者這是機器寫的;另一邊是有人真的讀過、改過,而且有人對這篇的發布負責,你不用掛。條文沒有要求那個人的名字要露出來,但你得留得下痕跡證明有人負責,實務上直接掛名最省事。同樣都用 AI 起草,兩邊在讀者眼前長得完全不一樣。

還有一件事可以讓你今晚睡好:歐盟執委會 7 月 20 日才通過對應指引,義務 8 月 2 日才生效,8 月 2 日之前已經生成並發布的內容不必回頭補標。你不用去翻三年份的舊文章。

罰則要講準,別被嚇到也別當沒事:違反第 50 條最高可罰 1,500 萬歐元或全球年營業額 3%,取高者——但這是歐盟的法,落到你頭上的前提是你在歐盟市場提供服務,或你的輸出結果在歐盟境內被使用。台灣多數品牌短期內不會被這筆罰款追著跑;不過條文寫的門檻是「輸出被誰用到」,不是「公司設在哪」,有在做英文內容的自己掂量一下。

先到的會是另外兩種場合。一種是平台自己的規矩:英文維基百科今年 3 月起禁止用大型語言模型生成或改寫條目正文(校對自己寫的字、輔助翻譯還留著),理由是查核跟不上生成:寫出來只要幾秒,把每一句話的出處查回去要幾小時,條目的可查證性就是這樣守不住的。另一種更近——等偵測工具照法規要求公開,你的客戶、你的競爭對手、下一個接手你網站的人,都可以拿去掃你發過的每一篇。那一天你會希望手上有東西可以拿出來說明。

還有一種更遠、但對做 GEO 的人更該想一下的可能。訓練資料被 AI 自己產的東西污染會怎樣,2024 年有一篇 Nature 論文做過實驗:把模型生成的內容反覆餵回去訓練,模型會退化,原始分布的尾巴會整段消失;作者的結論是合成資料不是不能用,而是過濾這件事必須認真做。過去沒有人有辦法可靠地把 AI 文從語料裡挑出來,浮水印把它變成技術上做得到的事。

誰也沒說要這樣用它,這一步未必會走。但代價值得先放在心上:那不是排名掉幾名,是你的內容從下一代模型的腦袋裡被洗掉——AI 回答問題時想不起你,因為它根本沒學過你。

現在要不要動

有兩件事不用做。不用停掉 AI 寫作,公開文件裡找不到任何一句支持「用了就會被搜尋引擎懲罰」;就算你擔心的是語料那一層,停用 AI 也不是解法——真的被過濾掉的是「沒有人負責的內容」,不是「用 AI 起草過的內容」。也不用現在跑去買市面上那些號稱「AI 偵測準確率 98%」的工具自我檢查——那類工具是在猜文字風格,跟這次講的浮水印是兩套完全不同的東西,拿去驗只會得到一個沒有意義的數字。

要動的是一件很不性感的事:在你的內容流程裡,指定一個真的會讀完、會改、而且願意具名的人,並且讓「他審過」這件事留得下痕跡。這一步同時解掉三件事——法規豁免的條件、維基百科那類平台的門檻、以及讀者對你網站的信任。它的底層邏輯跟去年開始鋪的那一整層來源憑證技術是同一件事:內容要能自己說清楚出身。

至於偵測工具什麼時候公開、各家引擎會不會拿這個訊號做點什麼,沒有人能給你日期——給你保證時程的人是在賣東西,這句話對我們一樣成立。

方向倒是不用猜了。內容的價值正在從「誰寫得出來」移到「誰為它負責」:前者從今年起人人都有,後者做不了假。

不確定自家內容產線現在站在那條線的哪一邊,我們可以先幫你看一次