當總統聲音被複製 專家揭AI深偽的國安、法律與信任危機
嘲諷中聯油品事件的影片「油不得你」以AI深偽(DeepFake)技術模擬賴清德總統的聲音,引發創作自由、言論自由與法律責任及國安風險間的爭議。學者、律師均示警利用AI技術假冒元首聲音恐成為認知作戰工具。AI專家並直言,隨著技術不斷向前推進,聲音、影像仿真門檻快速降低,未來真假資訊將更難辨識。
隨著AI人工智慧生成技術快速進步,政治攻防及嘲諷也出現新的表現形式。政治嘲諷影片「油不得你」韋姓製作人以AI技術模擬賴清德總統的聲音,批評政府處理中聯油脂食安事件,該影片雖標示由AI生成,但因高仿真國家元首的聲音,引發是否逾越政治諷刺界線,進一步涉及法律、國家安全與社會信任等議題的討論。
假冒國家元首恐成認知作戰工具
陽明交通大學科技法律學院院長陳鋕雄受訪指出,對政治人物批評、揶揄或諷刺原則上受到憲法言論自由保障,但國家元首與一般政治人物不同,其聲音與公開談話也象徵國家主權與指揮權,若藉深偽技術假冒,將被用作國安攻擊手段,成為認知作戰中的非對稱打擊工具。他說:『(原音)元首本身他有一些特殊的權力,像是宣戰、媾和或是國際外交等,所以當你假冒元首的話去講某些事情的時候,很可能會影響不單純是個人名譽的問題,因為他(元首)的公共職務,所以的確是有可能成為國家安全的問題,而且我們很確定這種手段是會被用來作為一種國安攻擊的手法。』
陳鋕雄舉例,在俄烏戰爭初期,網路就曾流傳一段利用AI深偽技術製作的烏克蘭總統澤倫斯基(Volodymyr Zelensky)影片,內容是要求烏克蘭軍民放下武器、向俄羅斯投降。儘管該影片被證實是造假,但也顯示敵對勢力透過冒用國家領導人形象,動搖軍心與社會信任的心戰手法。
同樣的風險也可能出現在選戰攻防,陳鋕雄指出,2023年斯洛伐克國會大選投票前2天,網路突然流出偽造親西方政黨領袖米哈爾.希梅奇卡(Michal Šimečka)的聲音檔案,內容宣稱他與記者密謀買票。由於當時已進入禁止宣傳競選的最後時刻,導致難以及時澄清,音檔迅速擴散,也影響後續選情。
陳鋕雄表示,因應此類風險主要有2條路徑。第一,要求網路平台快速移除未標示或具有危害的深偽內容;第二則是建立快速、持續的政府澄清機制。他以過去COVID-19疫情期間為例,當時大量假訊息在網路上流傳,政府透過固定記者會頻繁說明疫情及政策,便有助於建立官方資訊來源的公信力及避免假資訊持續擴散。
另外,陳鋕雄強調,當深偽技術的使用門檻持續降低,政府不可能攔截所有內容,公民辨識能力將成為民主社會最後一道防線,因此更重要的是將AI資訊識讀納入國中、小教育,讓民眾了解判斷資訊來源、交叉查證及辨識官方訊息的方法。
AI深偽內容管理法制仍待完善
在法律層面,律師黃任顯表示,現行刑事法律並非完全無法處理深偽案件,如利用偽造聲音或影像詐騙金錢涉及詐欺或加重詐欺;若藉此侵入他人電腦系統,也可能涉及妨害電腦使用罪。當深偽內容侵害個人的姓名、肖像、聲音或名譽時,當事人可依具體情況尋求民事及刑事救濟;若選舉期間有人意圖藉此使特定候選人當選或不當選,並足以損害公眾或他人時,也可能適用選罷法相關規定處理。
不過,黃任顯指出,若深偽內容沒有涉及詐財、侵入電腦,或尚未進入明確的選舉情境,現行法律能否處理就會面臨較大的解釋空間。他以這次「油不得你」影片深偽總統聲音為例,便有部分法律見解認為利用AI仿真聲音或影像可能涉及《刑法》偽造文書相關罪責,只是實務上以聲音作為「準文書」處理的判決並不多,未來法院會如何認定仍有待觀察。
雖然目前法律見解不一,但黃任顯強調未來必須謹慎面對此類風險。他指出,若有人利用總統、政府官員等深偽聲音或影像,捏造戰爭或市場重大訊息,一旦經媒體與社群平台傳播,可能會在短時間內造成市場波動及社會混亂,其危害已遠超過單純的名譽侵害。他說:『(原音)如果(深偽)更進一步發展,是偽造賴清德在總統府談話直播,這個造成的效果不是單純說言論自由、政治評論等可以簡單一句話就帶過的事情,因為這等於是在偽造一個政府,因為賴清德作為總統或是國家政要,他代表政府機關對外發表談話、講話的時候,偽造了這個moment他的效果,可能跟你說言論自由或政治諷刺、漫畫等效果,這是完全不一樣的兩件事情。』
至於影片中若清楚標示「AI生成」是否就可以免除法律責任?黃任顯表示,台灣尚未對AI生成內容建立完整規範,若未來法律明定標示「AI生成」列為行政執行的義務,完成標示或許可降低民眾受騙的風險,但不能直接推論所有內容都因此合法。
黃任顯強調,目前法制重點應是建立官方資訊驗證機制、AI內容揭露義務、平台快速辨識及下架程序,以及重大公共資訊來源的認證制度,民眾若能即時辨別真正的官方訊息,才能維持民主制度、社會秩序及國家安全。
上傳15秒聲音即可模仿 公眾人物更易擬真
專門研發AI虛擬主播及生成式影音技術的新創公司集仕多總經理梁哲瑋受訪表示,現行AI聲音複製技術大致可分成一般文字轉語音,以及擬真聲音複製兩個層次,部分網路開源模型僅需上傳約15秒聲音樣本,就能模仿特定人物說話,AI生成內容操作門檻已大幅降低。
他指出,基礎模型產生的聲音可能仍帶有機械感,若要製作高擬真聲紋,就需要更多乾淨的訓練資料,進一步學習說話者的情緒、音質、沙啞程度、斷句及停頓方式,而公眾人物像是總統、政治人物或藝人,經常公開演說及接受訪問,網路上累積大量其聲音與影像,製作者只要蒐集、去除雜音並純化資料,就可建立高度擬真的聲紋模型,因此,公眾人物更容易成為遭仿真的對象。他說:『(原音)如果是做一個簡單版,只需要15秒鐘的聲音就可以來稍微模仿,但它的模仿底層其實還是一般文字轉語音,所以你會聽起來還是有一點點機械音,但如果要做高擬真的話,像有一些國外的學術研究直接拿國會圖書館裡面總統的演講,它的聲音可能是數百個小時,而且是非常乾淨、沒有干擾,這樣的訓練資料庫是很大的,所以包含特色、頓點還有情緒起伏等,都可以學得非常非常像。』
至於該如何判斷影片是否由AI生成,梁哲瑋表示,通常需要綜合檢視幾何結構、臉部光線、景深、眼睛紋理、肢體動作及聲音等數十項細節,沒有任何單一標準可以保證判斷正確。他指出,部分研究會透過虹膜紋理、光線變化或細微影像訊號進行辨識,但通常僅適用於人物近距離的一對一視訊場景;若是假影片採取遠距離或長鏡頭呈現,眼睛與臉部細節不足,相關方法便難以發揮效果。因此,當AI技術進一步成熟,一般民眾很難僅憑肉眼或耳朵判斷真偽,往往必須透過專業程式或商用深偽辨識工具分析,目前國外已有業者提供相關偵測服務,部分國家是由政府投入研發、建立通報及鑑識機制,台灣政府也積極投入相關技術研發。
對於歐盟近日設立AI透明度新制,未來生成內容必須依法標示數位簽章與浮水印,梁哲瑋指出,相關技術可以記錄內容由何種工具生成,增加來源追溯能力,但最大問題在於是否能要求所有AI模型配合,即使歐盟或台灣訂定規範,也未必能約束未在境內營運的境外平台及開源模型,實際執行仍相當困難。
梁哲瑋認為,未來應廣泛蒐集產官學界意見,建立社會共識,再制定具有強制力的法規,作為平台配合的依據。他指出,目前不少在台營運的大型國際科技公司都會配合在地法令調整服務,因此可如同打擊詐騙訊息、著作權保護等方式逐步要求平台建立AI內容揭露、追溯及管理機制。
不過他也坦言,AI技術發展速度遠快於法規修訂,未來仍須持續觀察科技演進與法制建構的速度,盡量降低深偽內容帶來的風險,這也將是各國共同面臨的重要課題。(編輯:陳文蔚)