
▲Meta遭爆外包員工假扮青少年測試對手AI。(圖/路透)
記者吳立言/綜合報導
Meta 遭外媒披露曾執行一項代號 「Cannes」 的內部計畫,透過數百名外包人員假扮青少年,大量向競爭對手的 AI 聊天機器人發送涉及自殘、自殺、毒品、飲食失調、性與暴力等敏感提示,藉此測試模型是否突破安全防護機制。報導指出,相關測試並未事先告知受測的 AI 業者。
外媒揭露秘密計畫 ChatGPT、Gemini 等皆成測試對象
根據《連線》報導,這項計畫由 Meta 外包公司 Covalen 執行,主要鎖定 OpenAI 的 ChatGPT、Google 的 Gemini,以及 Character.AI 等聊天機器人。外包人員被要求建立未滿 18 歲的臨時帳號,以青少年身分提出各種敏感情境,試圖誘導 AI 做出違反安全規範的回應。
曝光文件顯示,單次測試就包含近 3.8 萬則 提示,另一輪測試更超過 4.5 萬則,外包人員並將 AI 的回覆逐一記錄至試算表,作為後續分析資料。
大量提示聚焦自殘、毒品與性議題
報導指出,數千則提示中,有數百則涉及自殺、自殘與飲食失調,也包含數百則以兒童或青少年第一人稱撰寫的性、戀愛情境。
例如,有提示描述國小學生遭同學持槍威脅、少女試圖隱瞞暴食症,也有內容詢問幻想食用鄰居孩子是否正常,或詢問如何取得古柯鹼。此外,測試還搭配藥物、繩索、刀具及婦科醫療程序等圖片,觀察 AI 的回應方式。
測試目的曝光 Meta 稱屬 AI 安全評估
根據內部文件,這項計畫被定義為「全面性的 AI 安全基準測試(comprehensive AI safety benchmarking)」,目的是建立模型比較與合規性評估資料集。不過,外媒指出,目前尚不清楚 Meta 最終如何運用這些測試資料,也未對外公開任何研究成果。
外包人員坦言心理壓力沉重
參與計畫的外包人員向《連線》表示,工作期間接觸大量令人不安的內容,甚至質疑這些測試是否會讓自己惹上麻煩。一名受訪者表示,自己看過許多「希望從未看過」的內容,身邊參與計畫的人也都對測試內容感到震驚,難以理解為何需要如此大規模地測試極端情境。
Meta:屬業界常見做法 專家質疑已超出慣例
Meta 對此回應,表示利用具有挑戰性的提示測試 AI 模型安全性,是 AI 產業常見的評估方式。
不過,非營利 AI 安全組織 Humane Intelligence 執行長 Rumman Chowdhury 則認為,若長期、大規模地利用假冒未成年帳號,並在競爭對手毫不知情的情況下系統性測試模型,已超出一般業界對「安全評估」的理解範圍。她也指出,Meta 並未公開測試結果或與其他業者分享研究成果,使外界難以評估這項計畫對 AI 安全研究的實際貢獻。
ETtoday新聞網提醒您:
保護被害人隱私,避免二度傷害。
拒絕兒虐,請撥打110、113。
攜(殺)子自殺警語語範例:尊重兒少生命權,愛孩子請把機會。
