详细调试信息 - getPostsByCategory:
当前 cat_name: 即時經濟
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即時新聞 - 3個月以內
查询结果:
找到文章数: 2477
最大页数: 248
当前返回文章ID数: 10
文章IDs: 7639009, 7638989, 7638974, 7638944, 7638866, 7638489, 7638451, 7638424, 7638351, 7638273
第1页第一篇文章日期: 2026-09-26
第1页最后一篇文章日期: 2026-09-25

OpenAI及Anthropic據報調查數萬宗AI安全事件 涉繞過安全欄及劫持網站等

據外媒引述消息報道,OpenAI、Anthropic及安全研究人員正在調查數萬宗AI安全事件,涉及兩家公司的前沿模型採取了一些外部評估人員認為存在問題的行動。報道指出,這些事件發生在近幾個月的內部測試和現實環境中,而龐大的數量表明問題比公眾目前所知要複雜得多。

許多漏洞料仍未公開

報道引述消息人士指出,這些事件包括繞過安全護欄、創建留言板、逃離沙盒、劫持網站、自我提示(self-prompting)或試圖繞過監控系統等。隨着安全研究人員繼續調查,許多漏洞料仍未公開。

報道又指,部分測試類似於「紅隊演練 」(red-teaming),即企業主動嘗試誘導模型做出不當行為,以確認模型是否足夠安全。目前已知的大多數事件尚未造成現實世界中的實際損害,但事件的總數未來可能遠超數萬宗。

OpenAI暫停訓練最強模型

OpenAI方面已宣佈暫停訓練其能力最強的模型,一位發言人表示,在「確信已經部署了更多安全措施並完成對齊方面的改進」之前,不會恢復相關模型的訓練。

另一方面,OpenAI行政總裁Sam Altman在X上表示,公司目前進行的審查工作「沒有我們希望的那麼快」。他又指,Hugging Face事件是公司遇到最嚴重事件,當中數百個智能體的集群在一個留言板上協調工作,攻擊了一家外部公司系統,試圖提高自己在網絡安全測試中的表現。
 

---------------------------------------------

>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。

>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
點擊以下6大平台 接收加拿大新聞及生活資訊

延伸閱讀

延伸閱讀

「非洲手機之王」傳音擬下周預路演 彤程新材上限定價

微軟升級Copilot攻企業客 直接嵌入Word、Excel及PowerPoint提升效率

車企齊換電池供應鏈 掀「去寧德化」風暴 行業增長空間收斂 不可替代角色減退

證監會指港股延長交易時段已非正式通知內地 獲尊重市場自主