详细调试信息 - getPostsByCategory:
当前 cat_name: 即時經濟
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即時新聞 - 3個月以內
查询结果:
找到文章数: 2478
最大页数: 248
当前返回文章ID数: 10
文章IDs: 7639145, 7143804, 7639009, 7638989, 7638974, 7638944, 7638866, 7638489, 7638451, 7638424
第1页第一篇文章日期: 2026-09-26
第1页最后一篇文章日期: 2026-09-26

OpenAI及Anthropic據報調查數萬宗AI安全事件 涉繞過安全欄及劫持網站等

據外媒引述消息報道,OpenAI、Anthropic及安全研究人員正在調查數萬宗AI安全事件,涉及兩家公司的前沿模型採取了一些外部評估人員認為存在問題的行動。報道指出,這些事件發生在近幾個月的內部測試和現實環境中,而龐大的數量表明問題比公眾目前所知要複雜得多。

許多漏洞料仍未公開

報道引述消息人士指出,這些事件包括繞過安全護欄、創建留言板、逃離沙盒、劫持網站、自我提示(self-prompting)或試圖繞過監控系統等。隨着安全研究人員繼續調查,許多漏洞料仍未公開。

報道又指,部分測試類似於「紅隊演練 」(red-teaming),即企業主動嘗試誘導模型做出不當行為,以確認模型是否足夠安全。目前已知的大多數事件尚未造成現實世界中的實際損害,但事件的總數未來可能遠超數萬宗。

OpenAI暫停訓練最強模型

OpenAI方面已宣佈暫停訓練其能力最強的模型,一位發言人表示,在「確信已經部署了更多安全措施並完成對齊方面的改進」之前,不會恢復相關模型的訓練。

另一方面,OpenAI行政總裁Sam Altman在X上表示,公司目前進行的審查工作「沒有我們希望的那麼快」。他又指,Hugging Face事件是公司遇到最嚴重事件,當中數百個智能體的集群在一個留言板上協調工作,攻擊了一家外部公司系統,試圖提高自己在網絡安全測試中的表現。
 

---------------------------------------------

>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。

>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
點擊以下6大平台 接收加拿大新聞及生活資訊

延伸閱讀

延伸閱讀

內地擬正式規管加熱捲煙 投機者可吼一個短炒機會|李聲揚

大摩世紀失誤 洩出敏感搵錢密碼|藍血工廠

定存攻略|港元定存掀加息潮 至少13間3厘或以上 美元定存高逾4厘 (附銀債退款優惠)

筍工|勞工處現「過膠師傅」空缺 月薪最高$2.8萬 無學歷要求惹熱議