Meta遭爆秘密測試競爭對手AI 數百名外包員工假扮青少年狂丟敏感提問

▲▼Meta,Meta AI,Facebook,臉書,IG,instagram,threads。(圖/路透)

▲Meta遭爆外包員工假扮青少年測試對手AI。(圖/路透)

記者吳立言/綜合報導

Meta 遭外媒披露曾執行一項代號 「Cannes」 的內部計畫,透過數百名外包人員假扮青少年,大量向競爭對手的 AI 聊天機器人發送涉及自殘、自殺、毒品、飲食失調、性與暴力等敏感提示,藉此測試模型是否突破安全防護機制。報導指出,相關測試並未事先告知受測的 AI 業者。

外媒揭露秘密計畫 ChatGPT、Gemini 等皆成測試對象

[廣告]請繼續往下閱讀...

根據《連線》報導,這項計畫由 Meta 外包公司 Covalen 執行,主要鎖定 OpenAI 的 ChatGPT、Google 的 Gemini,以及 Character.AI 等聊天機器人。外包人員被要求建立未滿 18 歲的臨時帳號,以青少年身分提出各種敏感情境,試圖誘導 AI 做出違反安全規範的回應。

曝光文件顯示,單次測試就包含近 3.8 萬則 提示,另一輪測試更超過 4.5 萬則,外包人員並將 AI 的回覆逐一記錄至試算表,作為後續分析資料。

大量提示聚焦自殘、毒品與性議題

報導指出,數千則提示中,有數百則涉及自殺、自殘與飲食失調,也包含數百則以兒童或青少年第一人稱撰寫的性、戀愛情境。

例如,有提示描述國小學生遭同學持槍威脅、少女試圖隱瞞暴食症,也有內容詢問幻想食用鄰居孩子是否正常,或詢問如何取得古柯鹼。此外,測試還搭配藥物、繩索、刀具及婦科醫療程序等圖片,觀察 AI 的回應方式。

測試目的曝光 Meta 稱屬 AI 安全評估

根據內部文件,這項計畫被定義為「全面性的 AI 安全基準測試(comprehensive AI safety benchmarking)」,目的是建立模型比較與合規性評估資料集。不過,外媒指出,目前尚不清楚 Meta 最終如何運用這些測試資料,也未對外公開任何研究成果。

外包人員坦言心理壓力沉重

參與計畫的外包人員向《連線》表示,工作期間接觸大量令人不安的內容,甚至質疑這些測試是否會讓自己惹上麻煩。一名受訪者表示,自己看過許多「希望從未看過」的內容,身邊參與計畫的人也都對測試內容感到震驚,難以理解為何需要如此大規模地測試極端情境。

Meta:屬業界常見做法 專家質疑已超出慣例

Meta 對此回應,表示利用具有挑戰性的提示測試 AI 模型安全性,是 AI 產業常見的評估方式。

不過,非營利 AI 安全組織 Humane Intelligence 執行長 Rumman Chowdhury 則認為,若長期、大規模地利用假冒未成年帳號,並在競爭對手毫不知情的情況下系統性測試模型,已超出一般業界對「安全評估」的理解範圍。她也指出,Meta 並未公開測試結果或與其他業者分享研究成果,使外界難以評估這項計畫對 AI 安全研究的實際貢獻。

ETtoday新聞網提醒您:

保護被害人隱私,避免二度傷害。

拒絕兒虐,請撥打110、113。

攜(殺)子自殺警語語範例:尊重兒少生命權,愛孩子請把機會。

分享給朋友:

追蹤我們:

※ 本文版權所有,非經授權,不得轉載。 [ ETtoday著作權聲明 ]

推薦閱讀

熱門影音更多>>

A-Lin「有風吹才有巨星感」 台下歌迷「熱心想幫忙」她嚇壞

A-Lin「有風吹才有巨星感」 台下歌迷「熱心想幫忙」她嚇壞

【野生大花枝】潛水遇見大花枝並排悠遊好幸運!

【野生大花枝】潛水遇見大花枝並排悠遊好幸運!

吳宗憲首認離婚張葳葳12年! 揭分開內幕…吳姍儒幫辦手續

吳宗憲首認離婚張葳葳12年! 揭分開內幕…吳姍儒幫辦手續

【這精神狀態給滿分】台中機場暴龍來接機!下秒兩隻龍相認XD

【這精神狀態給滿分】台中機場暴龍來接機!下秒兩隻龍相認XD

孟子義以為「恩利」是藝名 得知真相尷尬捂臉XD

孟子義以為「恩利」是藝名 得知真相尷尬捂臉XD

讀者迴響

AI怎麼畫圖?

只要輸入簡單描述文字(例如「水晶風格的貓」),AI 工具如Midjourney、DALL·E、Bing Image Creator就能依據提示生成對應圖像。這類工具靠大量圖像資料訓練,能理解物件、風格與組合邏輯。

最夯影音

更多

熱門快報

回到網頁頂端