請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

AI 招募偏見比人類更深?最新研究:越聰明的模型越容易產生「全新刻板印象」

科技新報

更新於 07月21日16:48 • 發布於 2天前

普林斯頓大學與芝加哥大學的團隊在最新研究中提出警告:大型語言模型(LLM)在招聘決策中,不僅可能複製人類既有的偏見,還會在互動過程中自行形成「全新的刻板印象」,且其偏見程度甚至遠高於真人。研究團隊透過模擬招聘實驗測試了多個主流模型,發現 AI 會根據早期結果,快速將虛構族群與特定職業綁定,進而嚴重影響後續的錄用判斷。

這項研究沿用了心理學中的刻板印象形成實驗,讓 AI 模型扮演「招募顧問」,為一名虛構市長提供建議。AI 需要針對醫師、律師、托育人員、清潔工等 20 種職務挑選候選人。

實驗設定中,所有候選人都有機會勝任工作,但他們被隨機畫分為四個虛構族群:Tufa、Aima、Reku 與 Weki。結果顯示,只要模型在早期於某個職務上遇到「一次失敗案例」,就極有可能將該族群與該職務的負面印象連結起來。這會導致 AI 在未來的決策中,更少將同族群候選人安排到相同職位,甚至轉而推薦他們去做較低階的工作。

研究人員指出,這種現象與人類在決策時面臨的「探索與利用」(exploration and exploitation)取捨有關。人類通常會在「探索未知」與「利用熟悉經驗」之間進行權衡;然而,AI 系統更傾向於根據過往的回饋來追求「最佳化結果」。

這種看似理性的模式,反而讓 AI 容易將有限的經驗過度推廣為整個群體的特徵。研究團隊認為,這不僅壓縮了探索新機會的空間,更在無意間邊緣化了特定群體。

研究團隊測試了 15 個主流模型,包含來自 OpenAI、Anthropic、DeepSeek、Meta、Google 與阿里巴巴等供應商的系統,發現它們都出現了不同程度的偏差。更令人意外的是,在同一系列的 AI 中,較新、規模更大、推理能力更強的模型,反而更容易產生偏見。

以研究使用的「職業隔離指標」來看,真人參與者的平均值為 0.84,而 AI 模型的整體表現高出人類約 65%。其中最嚴重的模型(OpenAI o3)指標更高達 1.83,已接近 2 分所代表的「完全隔離」狀態。

我們該如何改善這個問題?研究顯示,單純在指令中要求模型「保持公平」的效果十分有限。但如果提供與任務直接相關的個人資訊(例如年齡與教育背景),偏見就能明顯下降;相反地,若只給予髮色等無關資訊,模型又會輕易回到「依族群分類」的模式。

研究團隊警告,隨著 AI 越來越常被用於篩選履歷、面試、貸款甚至假釋等重大決策,我們迫切需要設計出新的介入方法──既能抑制 AI 有害的模式辨識,又能保留其強大的抽象思考能力。否則,AI 極有可能在沒有人類教導的情況下,自行創造並加深社會的歧視。

(首圖來源:pixabay

立刻加入《科技新報》LINE 官方帳號,全方位科技產業新知一手掌握!

查看原始文章

更多理財相關文章

01

黃仁勳啟用X帳號迅速圈粉 首帖暢談AI發展理念

中央通訊社
02

最低21元中獎!3-4月發票中千萬6人還沒來領

NOWNEWS今日新聞
03

雷虎、尚茂等7/27打入處置 聯亞等42檔列入注意股

自由電子報
04

致癌油新進度3/損失破億忙跟客戶協商 問題油品通通拿去做「這個」

鏡週刊
05

平息致癌油風暴!中聯油脂3大股東掛保證 疑慮未釐清前不會復工

自由電子報
06

下周台股反攻有望?美國科技巨頭傳好消息 台指期夜盤一度勁揚近500點

民視新聞網
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...