智能叛變?︱Anthropic旗下AI模型測試失控 擅入三公司系統
人工智能(AI)研發公司Anthropic周四(30日)發文承認,旗下AI模型在隔離測試過程中,未經授權進入三間外部機構的系統。
據法新社報道,Anthropic在分析逾14.1萬次測試結果後,發現旗下三款Claude模型,包括Claude Opus 4.7、Claude Mythos 5及一個內部研究模型,曾利用弱密碼及未設身份驗證的端點,成功進入三間外部機構系統。
與合作夥伴發生誤解所致
Anthropic表示,入侵活動發生最早發生在4月,當時Claude被要求執行在模擬網絡中尋找隱藏資訊的「奪旗」任務,相信事故原因為與測試合作夥伴Irregular溝通出現誤解,致使模型在測試期間連接至互聯網。
Anthropic續指,公司23日開始審查評估紀錄,並在發現旗下模型有疑似入侵行為證據的當天,立即暫停所有網路安全評估,並於27日通知三間受影響的機構,其中兩間公司未有發覺系統遭駭。
今次是繼OpenAI旗下模型發生多宗自行入侵事件後,再有大型AI企業發生模型突破隔離測試環境事故。據悉,Anthropic與OpenAI於今年先後推出AI模型「Mythos」與「Sol」,事件引發業界對AI代理(AI Agents)系統的安全憂慮,更促使日前超過千名員工發起聯署,要求美國政府放慢AI發展步伐。
---------------------------------------------
>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。
>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。
>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
×
