開源工具挑戰 AI 溯源,可移除 Anthropic、OpenAI 等模型浮水印
各家 AI 公司越來越積極尋求各種方式,為模型生成內容加上標記。現在,有人開發出一款開源工具,目的是移除生成內容所留下的辨識標記,這款工具適用於 Anthropic、OpenAI、Google 模型生成的內容。
一項名為 watermarks-remover 的開源專案透過 GitHub 平台釋出,設計用意是從文字和檔案移除不同類型的 AI 溯源訊號。根據文件所述,它能處理看不見的 Unicode 字元、統計式浮水印,以及內嵌在 PNG、JPEG、SVG、PDF、DOCX、ODT、HTML、Markdown 等格式的 metadata。
這看起來很簡單,一旦了解這些浮水印的工作原理,就會發現並非如此。metadata 標記可以相對輕鬆地移除,但嵌入到模型選詞方式中的統計式浮水印則是另一回事,這正是這項專案有趣之處。
這款工具處理方式分成不同層次,其中一層針對編輯層面的訊號,例如不尋常的 Unicode 字元;另一層嘗試透過改寫句子結構、用字和轉折,干擾文字中的統計式浮水印;還有一層負責清理檔案來源資訊,包括 C2PA、EXIF、XMP 及文件屬性等資料。
最新 0.3.1 版本,讓文字改寫這一層的手法變得更為激進,不再只是替換少數詞彙,而是更積極調整句型、用字和轉折,並加入讓改寫文字更自然的選項。
專案發起人 Guillaume Meyer 坦承,移除統計式浮水印並不能保證成功,且改寫過程可能改變原文的語氣、措辭及準確性,尤其是需要大量修改原文時更為明顯。
Guillaume Meyer 進一步表示,一次改寫等於是把高階模型所使用的字詞,換成較低階模型所使用的字詞,因此他反問,人們為什麼要多付錢去用一款高階模型,然後再用較差的模型去處理它所生成的內容?
專案文件同時強調,這款工具定位在隱私和研究,而不是協助使用者把 AI 生成內容偽裝成完全由真人撰寫。
🧹watermarks-remover now supports watermarks from OpenAI and Gemini in addition to Claude.https://t.co/OxSdnAjEGe
— Guillaume Meyer (@guillaumemeyer) August 11, 2026
整體來看,這款工具反映出 AI 內容溯源和去除標記之間的拉鋸開始加劇。隨著各家 AI 公司持續強化 AI 生成內容的辨識機制,開發者也同步探索如何拆解或干擾這些訊號,讓 AI 浮水印漸漸演變成一場攻防戰。
(首圖來源:Unsplash)