AI 行業最近出現咗一個好有趣嘅現象:AI 實驗室正在大量購買印刷版舊書——真係實體書,紙同膠水嗰種。ISBNdb,一間專為 AI 實驗室採購批量印刷書籍嘅經紀公司,直接咁樣推銷:「世界上最好嘅 AI 訓練數據就喺書架上。」而呢個策略之所以有效,係因為呢啲書有一個任何 prompt engineering 都偽造唔到嘅特性——佢哋喺 AI 垃圾內容泛濫之前已經存在。
資料來源:Search Engine Journal 獨家分析,由前 Google 搜尋品質及 Webspam 團隊成員 Pedro Dias 撰寫。
一、呢個現象點解對香港企業咁重要?
過去兩年,我哋見到大量「AI 內容農場」湧現——用 AI 大量生成文章去搶搜尋排名。唔少香港 SEO 公司甚至鼓勵客戶「內容量產」,話只要出夠多文章就會有排名。但呢個策略正喺度面臨一個結構性嘅威脅:AI 模型嘅開發者自己都唔想要 AI 生成嘅內容。
呢個矛盾好諷刺:AI 公司開發咗生成內容嘅工具,然後佢哋要俾真金白銀去買印刷版舊書,以免自己嘅模型學到由自己嘅工具產生嘅內容。同時,成個 GEO(Generative Engine Optimization)產業鏈仲喺度收月費,鼓勵企業不斷餵 AI 內容俾呢啲同一個系統。正如 Pedro Dias 所講:「呢條供應鏈入面,一定有人睇錯咗個市場。」
二、AI 內容檢測基礎設施已經到達網絡規模
SynthID:Google 嘅不可見浮水印系統
2026 年 5 月嘅 I/O 大會上,Google 宣布 SynthID 已經標記咗 超過 1,000 億張 AI 生成嘅圖片同影片,以及大約 60,000 年長度嘅音頻。呢啲檢測功能已經整合到 Google Search 同 Chrome 瀏覽器入面。OpenAI 亦承諾喺所有通過 ChatGPT、Codex 同 API 生成嘅圖片中嵌入 SynthID。
Anthropic:文字級別嘅 AI 浮水印正式上線
呢個係最關鍵嘅發展。Anthropic 已簽署歐盟 AI 法案嘅透明度行為準則,並公布咗佢哋嘅計劃:由 2026 年 8 月 2 日起推出嘅 Claude 模型,將在生成文字中強制嵌入模型級別嘅浮水印,適用範圍包括 API、消費者應用程式同雲端平台。
雖然法律觸發點係歐盟,但因為個浮水印係內置喺模型入面,所以歐盟嘅規定變相成為全球默認標準。Anthropic 表示會協助第三方檢測呢啲浮水印,但具體機制要等「即將發布嘅技術文檔」——前 Google 搜尋品質團隊成員 Pedro Dias 評論話:「呢個措辭值得細味」。
重要嘅注意事項
- OpenAI 嘅承諾目前只覆蓋圖片,文字浮水印仍係研究階段
- Google DeepMind 表明開源嘅 SynthID 文字版本只係「研究論文嘅參考實現,唔適合生產使用」
- 已知弱點:經過大量改寫或翻譯後,檢測可信度會明顯下降;短段落輸出亦比較難檢測
- 但關鍵係:公開嘅版本唔等於實際運行嘅版本。Google 從來冇公開過垃圾檢測嘅運作機制——「公開機制就等於交出規避手冊」
三、對香港企業嘅實際啟示
1. 「內容量產」策略嘅保質期正在倒數
如果 AI 模型開發者唔想自己嘅模型學到 AI 生成內容,而 Google Search 嘅垃圾檢測系統正在逐步整合 AI 內容浮水印,咁依賴大量 AI 生成內容去搶排名嘅策略,長遠一定會失效。呢個唔係「會唔會」嘅問題,而係「幾時」嘅問題。
2. 真正嘅專業內容先係長期資產
呢個趨勢對香港中小企嚟講其實係一個好消息——如果你一直堅持寫真正有價值嘅內容(香港市場分析、本地案例、專業見解),而唔係用 AI 大量複製改寫,你嘅內容反而會變得更有價值。因為 AI 模型需要使用高品質、非 AI 生成嘅數據來訓練,而你嘅專業內容就係呢種稀缺資源。
3. E-E-A-T 變得更加重要
Google 嘅 E-E-A-T(經驗、專業知識、權威性、可信度)框架一直係搜尋品質嘅核心。喺 AI 內容檢測能力不斷增強嘅情況下,真正有作者背景、有原始研究、有真實案例嘅內容,將會更容易獲得搜尋排名同 AI 搜尋嘅引用。
四、香港企業應該點樣調整內容策略?
- 減少對 AI 批量生成內容嘅依賴:AI 可以作為輔助工具( brainstorming、校對、翻譯),但唔應該作為主要內容生產方式
- 投資原創研究同數據:香港市場嘅獨特數據、行業調查、客戶案例,呢啲係 AI 取代唔到嘅
- 建立作者權威:確保每篇文章都有明確嘅作者背景同專業資歷,符合 E-E-A-T 要求
- 避免純工具性內容:純粹為 SEO 而寫、冇實際價值嘅「關鍵字填充」文章,將會係最先被篩選嘅目標
- 關注 AI 搜尋嘅引用模式:利用 Search Console 嘅 AI 搜尋報表,分析你嘅內容喺 AI 平台嘅曝光同引用情況
- 保持內容更新:定期檢討同更新現有內容,確保資訊準確同即時——Google 同 AI 模型都傾向引用最新嘅資訊
五、總結:內容嘅「稀缺性」正在回歸
AI 行業嘅發展出現咗一個有趣嘅悖論:AI 模型需要大量高品質、非 AI 生成嘅數據來訓練,但同時 AI 生成工具正在大量製造低品質內容,污染緊訓練數據庫。結果係,真正由人類專家撰寫嘅專業內容變得更加稀缺,更有價值。
對於香港嘅中小企同市場營銷人員,呢個趨勢嘅啟示好清晰:與其追逐「量產 SEO」嘅短期排名遊戲,不如投資建立真正有深度嘅專業內容。呢啲內容唔單止對搜尋排名有長期價值,仲會成為 AI 模型樂意引用嘅可信來源。
正如 Pedro Dias 所講:「舊嘅搜尋足夠確定性去建立一個行業。排名係一個位置,位置產生曝光同點擊,點擊帶住 tracking parameters 進入分析系統,話俾你知咩轉換咗。而 AI 答案對任何人都唔會 hold still——問同一個問題兩次,推薦嘅品牌可以唔同。」喺呢個新嘅搜尋環境入面,內容品質唔再只係「好唔好」嘅問題,而係關乎你嘅內容會唔會俾搜尋引擎同 AI 模型信任嘅根本問題。
想了解你嘅內容策略係咪符合 AI 搜尋時代嘅要求?
我哋為香港企業提供 SEO 同 GEO 策略諮詢服務,幫你分析現有內容品質、評估 AI 搜尋曝光機會,以及制定可持續嘅內容策略。立即預約免費諮詢。
預約免費諮詢