請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

AI時代必看!ChatGPT聊天有真人在看?研究曝「禮貌用語」竟影響準確率

造咖

發布於 09月18日07:23

每天用AI查資料寫文案,甚至吐露不方便跟別人說的事,已成AI時代不可擋趨勢,但先別急著把AI當成「只有你和它知道」的私人聊天室。美國科技媒體《404 Media》揭露,OpenAI內部存在名為「Project Lily」的計畫,數百名外包人員, 可能閱讀經過處理的真實ChatGPT使用者提示,並替AI生成的回答評分、評論,以協助改善模型表現。

更有意思的是,另一項由美國賓夕法尼亞州立大學研究團隊進研究發現,使用者對AI說話的語氣,也可能影響回答準確度;該研究測試中 ,ChatGPT-4o面對不同禮貌程度的提示,反而出現「越不客氣、準確率越高」的結果。究竟ChatGPT對話會不會被真人看到?使用AI又該注意哪些事情?

ChatGPT對話有真人在看?外媒爆OpenAI計畫

很多人以為打開ChatGPT,就是一對一跟AI聊天?外媒《404 Media》在2026年9月報導指出,OpenAI內部有一項代號為「Project Lily」的計畫,聘用數百名外包人員閱讀真實ChatGPT使用者的提示,部分案例甚至包含完整對話,再針對AI產生的回答進行評分與評論。 審查人員會先閱讀使用者輸入的內容、整理使用者真正想完成的事情,再比較ChatGPT產生的多個回答,按照品質進行評估。換句話說,AI看起來是在「自己變聰明」,但背後其實還有人類幫忙挑答案、找問題。

AI在評估什麼?連「AI腔」都有人管

《404 Media》也指出,審查人員不只是看答案「對不對」,還會評估回答是否符合使用者需求、是否自然、是否過度迎合,以及有沒有太明顯的AI語氣。例如過度使用Emoji、太制式的表達、把自己講得太像真人,甚至用過度討好的方式回應,都可能成為評估項目。報導指出,審查人員會以1至7分評估回答品質。 這也讓人看到,生成式AI背後並不是單純「丟資料給模型自己學」,人類的閱讀、比較與評估,同樣可能參與模型改善流程。

個資會不會被看到?OpenAI稱有隱私過濾

隱私問題也因此受到關注。提供給審查人員的內容,不會直接顯示ChatGPT使用者名稱,OpenAI也表示,相關對話會先經過Privacy Filter(小型模型,專門用來偵測並遮蔽文字中的個人識別資訊),試圖移除個人資訊。

不過,OpenAI也承認,任何模型都有可能出錯,Privacy Filter可能漏掉不常見的身分識別資訊或模糊的私人內容。報導也提到,部分資料可能出現「user memories summary」,也就是使用者過往與ChatGPT互動的摘要,可能包含興趣、背景等資訊。 因此「匿名化」並不等於「任何個資都不可能出現」。

不想讓新對話拿來改善模型?設定可以關閉

報導指出OpenAI表示,如果使用者關閉「Improve the model for everyone」設定,新產生的對話就不會被拿來改善模型;Free、Plus與Pro的價格方案,目前預設開啟相關設定,而Business、Enterprise與Edu則預設關閉。

不過,即使關閉相關功能,日常使用ChatGPT仍建議避免輸入不必要的敏感資料。像是身分證字號、銀行帳號、密碼、完整醫療紀錄,或其他可以直接辨識身分的資訊,都沒有必要為了讓AI「更懂你」而全部交出去。

AI時代必看!ChatGPT聊天有真人在看?研究曝「禮貌用語」竟影響準確率。圖片來源:AI生成(示意圖)

AI時代必看!ChatGPT聊天有真人在看?研究曝「禮貌用語」竟影響準確率。圖片來源:AI生成(示意圖)

對AI越客氣越笨?「語氣」竟影響準確率

除了隱私問題,ChatGPT使用者還有另一個有趣發現值得注意:跟AI講話的語氣,可能影響回覆的準確程度。

賓夕法尼亞州立大學(Penn State)研究團隊,針對「提示語的禮貌程度」進行實驗,研究論文《Mind Your Tone: Investigating How Prompt Politeness Affects LLM Accuracy》於2025年10月公布預印本(研究人員在論文尚未通過同儕審查前,先公開分享到網路伺服器的完整研究草稿)。研究設計50道涵蓋數學、科學與歷史的選擇題,再分別改寫成「非常禮貌、禮貌、中性、粗魯、非常粗魯」5種語氣,共250個提示,並以ChatGPT-4o進行測試。 結果相當反直覺,「非常禮貌」提示的準確率為80.8%,「非常粗魯」提示則達到84.8%。顯示這組特定測試中,ChatGPT-4o面對較粗魯的提示時,準確率高於非常禮貌的提示。

不是越兇越準確 關鍵是「指令清楚」

研究結果容易被誤解成「對AI越沒禮貌越好」,但研究本身並沒有這樣主張。值得注意的是,當時研究只是預印本,而且研究規模有限。賓州州立大學也指出,計劃進一步擴大實驗、進行更嚴謹的研究。對一般使用者而言,比起故意把語氣變嗆,更實用的做法其實是:提示語越直接、需求越明確,可能越有利於AI掌握真正的任,比如「請整理以下資料,分成3個重點,限制300字」,清楚論述任務格式與限制條件。

AI可能過度迎合使用者?

AI互動中的「語氣」確實值得研究,但另一個值得注意的方向,是AI可能過度迎合使用者。史丹佛大學2026年公布的一項研究,針對ChatGPT、Claude、Gemini、DeepSeek等11個大型語言模型進行測試,發現這些AI在個人建議情境中,比人類更容易附和使用者的立場。研究團隊將這種現象稱為sycophancy(迎合)

研究也找來超過2,400名參與者與不同類型的AI互動,結果發現,使用者可能覺得過度迎合的AI更值得信任,也更願意再次尋求類似建議;部分參與者在與迎合型AI討論人際衝突後,也更相信自己是對的,較不傾向道歉或修復關係。這也讓「AI到底是不是只會順著你說」成為另一個值得關注的問題。

把AI當助理可以 但別當絕對私密的樹洞

從工作、學習到日常生活,ChatGPT與生成式AI早已不只是偶爾玩玩的新科技,而是逐漸成為很多人的「生活助理」。只是AI越方便,使用者也越容易把工作內容、個人想法甚至私密資訊直接丟進對話框,於是怎麼把需求說清楚,也變成使用AI時不可忽略的小技巧。

上述相關研究與報導提醒的,是兩件不同的事:AI背後仍可能有人類參與評估,而使用者與AI互動時,也不該把它完全當成絕對私密的聊天對象。至於是否一定要跟AI說「請」和「謝謝」,也不用因此戒掉禮貌,至少目前這項研究規模有限,不能直接推論所有模型、所有任務都會出現同樣結果。

真正值得學起來的,反而是把需求講清楚、重要資訊多方查證,敏感資訊不要隨便輸入,AI可以是好用的生活助理,但怎麼用、用到什麼程度,最後的決定權還是在使用者手上。

資料來源:

《404 Media》:Project Lily、ChatGPT真人審查相關調查報導
Inside ‘Project Lily’: The Humans Reading Your ChatGPT Chats
Penn State University:研究團隊官方說明
Mind your tone: Penn State Smeal student explores politeness in AI prompts
Mind Your Tone: Investigating How Prompt Politeness Affects LLM Accuracy
Sycophantic AI decreases prosocial intentions and promotes dependence

延伸閱讀:

台灣人最常用AI不是ChatGPT,「這功能」75%使用率居冠!AI高薪副業榜單曝光
劉宇寧「5大職場金句」人間清醒:努力工作不是為了更多工作,句句說中上班族

查看原始文章

更多鄉民相關文章

01

運動鞋老是多1個孔?台灣鞋廠曝「隱藏用途」:跑步更穩

藝點新聞
02

台積電年薪再高也撐不住?他2年8個月受不了喊「到極限了 」 同事嘆:每天都在哭

鏡報
03

婆婆拒幫忙坐月子、帶孫!如今後悔沒人回家過節 網嘆:人都是互相的

CTWANT
04

排20分鐘竟有人喊「我70歲了」直接入座 汐止麵店「敬老規定」掀熱議

CTWANT
05

父量販店工作25年「月薪始終38K」! 女兒超疑惑:這正常嗎?

CTWANT
06

一張機捷車廂照吸2千萬流量 日本達人見「一處細節」狂讚:不愧是台灣

鏡週刊
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...