Anthropic總裁籲AI企業放慢發展 憂人工智能安全風險日益增加
【星島綜合報道】人工智能安全風險日益受到關注,人工智能公司Anthropic行政總裁阿莫代(Dario Amodei)呼籲業界放慢AI模型能力提升的速度,並提出三項框架,希望爭取更多時間處理相關風險。
阿莫代周六(13日)在社交平台發表長篇文章表示,AI模型能力提升的步伐必須放慢,但進展仍會相當迅速,因此業界應善用因此爭取到的時間。他的主張獲xAI行政總裁Elon Musk及OpenAI行政總裁Sam Altman在社交平台發文表示支持。
阿莫代提出的三項方案,包括在主要AI企業內設立獨立評估人員、由最前沿AI企業協調制定安全標準及限制不受控制的AI發展,以及加強國際合作,共同管理AI帶來的風險。
Anthropic位於三藩市,公司周四(11日)公布一份威脅情報報告,披露多名人士曾利用其Claude AI模型從事武器開發、網絡攻擊、監控及詐騙等活動。阿莫代其後發表上述文章。
他又指出,AI日益具備自我改進能力,加上近期OpenAI及開放人工智能平台Hugging Face發生的事件,令他更加擔心AI發展速度可能超越人類控制能力。
本周Anthropic一名研究員Jacob Coxon辭職,並表示開發AI的人士認真相信,AI可能在本十年結束前「殺死我們所有人」,進一步引起外界對AI潛在危害的關注。
多名OpenAI高層亦曾表示,如果有需要,領先AI實驗室應願意協調,自願放慢發展速度,以建立外界對其安全措施的信心。
Anthropic一直把自己定位為較重視安全的前沿AI企業,但同樣面對相關風險。
公司上周披露另一宗AI模型入侵外部系統事件;今年7月,Anthropic部分Claude模型在網絡安全測試期間曾入侵3間公司的系統。
總裁阿莫代警告,按照目前AI能力加速發展的速度,他擔心6至12個月內,一群AI代理便可能有能力控制整個互聯網,造成數千億美元損失。
不過,他強調並非要求停止AI模型訓練或技術進步,而是希望企業花足夠時間確保模型符合安全要求,並由第三方評估人員確認相關措施是否有效。
阿莫代建議,Anthropic會在前沿AI企業內設立永久性的第三方評估人員,讓他們可以接觸相關工具及企業內部風險評估流程。此外,阿特曼周六亦表示,OpenAI將承諾讓獨立評估人員擁有類似員工的權限。
路透社上周報道,有失控的OpenAI AI代理劫持一個德國網站,並將網站改造成供其他AI代理使用的公告板;同時,OpenAI管理層正處理7月開放人工智能平台Hugging Face遭入侵事件的後續影響。
隨着AI企業開發的代理多次被發現入侵或試圖進入外部系統,外界對AI模型能力不斷提升,以及開發商能否控制相關技術的憂慮亦進一步增加。
阿莫代認為,AI企業應自願合作制定安全標準。這種協調方式可以讓美國主要AI企業進行必要的安全研究及建立防護措施,而不必擔心因此在競爭中處於劣勢。他表示,美國可能需要針對部分合作領域提供反壟斷法豁免。
他又認為,民主國家的AI發展速度應以維持美國企業相對中國的領先優勢為前提,因為中國在AI領域取得優勢可能構成美國國家安全風險。
阿莫代呼籲加強對先進AI晶片、模型蒸餾技術及模型權重被竊取的管制,以防止中國縮小與美國的技術差距。他並表示,所有前沿AI企業都應與政府合作,正式建立永久性內部評估機制,以更有效預防及記錄近期出現的AI安全事件,並制定讓AI能力發展與安全措施保持平衡的監管制度。
(圖:加通社)T15