
▲Claude Code遭爆暗藏偵測程式。(圖/Anthropic)
記者吳立言/綜合報導
Anthropic 旗下程式開發工具 Claude Code 近日爆出隱藏程式碼爭議。有安全研究人員指出,該程式自今年 4 月起便內建一段未公開的偵測機制,直到 7 月 1 日才被移除,期間官方未在更新日誌或文件中說明,引發開發者對透明度與信任的討論。
這起事件最初由 Reddit 網友透過逆向分析 Claude Code 的二進位檔案發現,隨後多名安全研究人員完成多個版本的程式碼分析,海外媒體也於 7 月 1 日進一步報導相關內容。
透過 Unicode 隱寫技術標記特定使用環境
研究人員指出,這段隱藏程式會在使用者自訂 API Proxy(代理)介面時啟動檢查,主要比對裝置時區,以及是否連線至特定代理網域。據分析,程式內部包含一份經過加密混淆的網域名單,解密後涵蓋多家 AI 服務供應商與代理服務。若符合特定條件,系統便會將部分文字替換為特殊 Unicode 字元,藉此嵌入肉眼難以辨識的標記資訊,作為後續辨識依據。
另含反蒸餾機制 可能注入干擾資料
除了環境辨識外,研究人員也發現程式內建所謂的「反蒸餾(Anti-distillation)」機制。當符合特定條件時,系統可能自動插入虛假的工具呼叫(Tool Calls)資訊,藉此降低第三方蒐集 Claude Code 輸出內容進行模型訓練的效果。
不過,也有研究人員指出,此類設計可能影響正常企業代理環境的使用者,存在誤判風險,因此引發對產品透明度與權限管理的討論。
針對外界質疑,Anthropic 表示,相關功能屬於短期實驗,目的是打擊帳號轉售等濫用行為,而非蒐集使用者資料,目前最新版 Claude Code 已全面移除相關程式碼。
不過,由於 Claude Code 具備讀取本機專案、修改檔案等高權限能力,事件仍讓部分開發者認為,即使功能已移除,未事先揭露的底層偵測機制仍可能影響對產品的信任,也再次凸顯 AI 開發工具在透明度與安全治理上的重要性。
