請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

開源工具挑戰 AI 溯源,可移除 Anthropic、OpenAI 等模型浮水印

科技新報

更新於 08月15日00:55 • 發布於 08月15日07:59

各家 AI 公司越來越積極尋求各種方式,為模型生成內容加上標記。現在,有人開發出一款開源工具,目的是移除生成內容所留下的辨識標記,這款工具適用於 Anthropic、OpenAI、Google 模型生成的內容。

一項名為 watermarks-remover 的開源專案透過 GitHub 平台釋出,設計用意是從文字和檔案移除不同類型的 AI 溯源訊號。根據文件所述,它能處理看不見的 Unicode 字元、統計式浮水印,以及內嵌在 PNG、JPEG、SVG、PDF、DOCX、ODT、HTML、Markdown 等格式的 metadata。

這看起來很簡單,一旦了解這些浮水印的工作原理,就會發現並非如此。metadata 標記可以相對輕鬆地移除,但嵌入到模型選詞方式中的統計式浮水印則是另一回事,這正是這項專案有趣之處。

這款工具處理方式分成不同層次,其中一層針對編輯層面的訊號,例如不尋常的 Unicode 字元;另一層嘗試透過改寫句子結構、用字和轉折,干擾文字中的統計式浮水印;還有一層負責清理檔案來源資訊,包括 C2PA、EXIF、XMP 及文件屬性等資料。

最新 0.3.1 版本,讓文字改寫這一層的手法變得更為激進,不再只是替換少數詞彙,而是更積極調整句型、用字和轉折,並加入讓改寫文字更自然的選項。

專案發起人 Guillaume Meyer 坦承,移除統計式浮水印並不能保證成功,且改寫過程可能改變原文的語氣、措辭及準確性,尤其是需要大量修改原文時更為明顯。

Guillaume Meyer 進一步表示,一次改寫等於是把高階模型所使用的字詞,換成較低階模型所使用的字詞,因此他反問,人們為什麼要多付錢去用一款高階模型,然後再用較差的模型去處理它所生成的內容?

專案文件同時強調,這款工具定位在隱私和研究,而不是協助使用者把 AI 生成內容偽裝成完全由真人撰寫。

整體來看,這款工具反映出 AI 內容溯源和去除標記之間的拉鋸開始加劇。隨著各家 AI 公司持續強化 AI 生成內容的辨識機制,開發者也同步探索如何拆解或干擾這些訊號,讓 AI 浮水印漸漸演變成一場攻防戰。

(首圖來源:Unsplash

立刻加入《科技新報》LINE 官方帳號,全方位科技產業新知一手掌握!

查看原始文章

更多理財相關文章

01

打房重傷建材業!訂單腰斬、百家磚廠慘剩19家 9公會呼救:傳產將湧倒閉潮

太報
02

當股東大勝當員工!聯發科8月分紅傳打85折、平均較2月縮水降至80萬

太報
03

3天獲利近4億!黃立成高槓桿翻身「經典名言」回應了

民視新聞網
04

跟著「千張大戶」選股!萬海、欣興、華碩、東元…一表摸透18檔獲利爆發、籌碼支撐股,不怕黑天鵝亂入

今周刊
05

72萬股東嗨了!外資大買365億狂掃「這檔」奪冠 力積電同步上榜

自由電子報
06

輝達財報開獎倒數!分析師示警「C波大跌」 預言台股恐下探31117點

太報
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...