請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

數發部啟動民間語料徵集 擴大臺灣AI訓練資料庫

青年日報

更新於 1小時前 • 發布於 1小時前
數發部舉行「臺灣主權AI訓練語料庫啟動民間語料徵集」活動,目前已有許多出版單位及作者表態支持這項計畫。(記者吳典叡攝)

記者吳典叡/臺北報導

由於國際大型AI模型大量採用中國大陸網路語料訓練,可能導致模型在歷史、政治等議題受到中國大陸觀點影響。數位發展部長林宜敬今(15)日指出,數發部啟動民間語料徵集計畫,鼓勵民間自願提供具臺灣觀點資料、著作,用於訓練AI語料,並開放全球AI開發團隊使用,期盼讓臺灣觀點透過AI傳遞至全球。

數發部今日在digiBlock C數位創新基地舉辦「臺灣主權AI訓練語料庫啟動民間語料徵集」記者會,林宜敬表示,面對AI發展,並非要限制AI可以回答什麼,而是必須正視大型語言模型(LLM)訓練資料來源所造成的影響。其中,以「臺灣觀點AI評測」為例,「二次大戰中國戰場的主力是國軍還是共軍?」。數發部用這類具有臺灣社會共識、但中共官方敘事不同的問題,來測試大型語言模型。

林宜敬說,「LLM不只是語言能力問題,也可能受到訓練資料與不同歷史敘事影響」的案例。甚至,有些大型模型甚至會回答「共軍」,因此臺灣的AI評測中心才把這類題目納入「臺灣價值觀/臺灣觀點」的評測。

林宜敬也說,國際間對AI使用著作權內容進行模型訓練,仍在討論相關規範,形成共識可能需要數年時間。不過,隨著AI技術快速發展,臺灣不能等到規範底定後才行動,否則,臺灣觀點恐難透過AI傳遞至全球。為此,政府推動民間語料徵集計畫,希望增加具臺灣觀點的AI語料。

林宜敬表示,除釋出政府擁有的著作,也向民間徵集語料,並開放臺灣及全球AI開發團隊使用,包括美國、日本及中國大陸等地;徵集語料僅限用於AI訓練,AI生成內容不得直接重製原文,須經過轉化,以符合合理使用原則。

數發部指出,該項計畫採自願性參與,而非強制參加,若未來作家、出版社想法有變,也能隨時終止授權;林宜敬也以作家身分率先響應,將個人著作授權作為AI訓練語料,希望藉此帶動更多民間創作者參與。

查看原始文章

健康指南:防範胃癌

更多生活相關文章

01

沖繩被當台分店?飯店崩潰喊:國旅補助不了

NOWNEWS今日新聞
02

「超級聖嬰」正式成形!強度飆破歷年同期紀錄 恐一路延續至2027

CTWANT
03

綠鬣蜥大軍入侵東港!立委家也遭殃 「徒手活捉」畫面曝光

TVBS
04

燉肉吃一半出事了!孩子數「八角」竟有13角 真相嚇壞媽

CTWANT
05

國民泡麵消失!一堆童年零食沒了 網淚:以前水壺都是「它」

壹蘋新聞網
06

中秋小心!月餅暗藏熱量炸彈 醫:一顆蛋黃酥得走70分鐘

壹蘋新聞網
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...