详细调试信息 - getPostsByCategory:
当前 cat_name: 即时经济
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即时新闻 - 3个月以内
查询结果:
找到文章数: 2477
最大页数: 248
当前返回文章ID数: 10
文章IDs: 7639009, 7638989, 7638974, 7638944, 7638866, 7638489, 7638451, 7638424, 7638351, 7638273
第1页第一篇文章日期: 2026-09-26
第1页最后一篇文章日期: 2026-09-25

OpenAI及Anthropic据报调查数万宗AI安全事件 涉绕过安全栏及劫持网站等

据外媒引述消息报道,OpenAI、Anthropic及安全研究人员正在调查数万宗AI安全事件,涉及两家公司的前沿模型采取了一些外部评估人员认为存在问题的行动。报道指出,这些事件发生在近几个月的内部测试和现实环境中,而庞大的数量表明问题比公众目前所知要复杂得多。

许多漏洞料仍未公开

报道引述消息人士指出,这些事件包括绕过安全护栏、创建留言板、逃离沙盒、劫持网站、自我提示(self-prompting)或试图绕过监控系统等。随着安全研究人员继续调查,许多漏洞料仍未公开。

报道又指,部分测试类似于“红队演练 ”(red-teaming),即企业主动尝试诱导模型做出不当行为,以确认模型是否足够安全。目前已知的大多数事件尚未造成现实世界中的实际损害,但事件的总数未来可能远超数万宗。

OpenAI暂停训练最强模型

OpenAI方面已宣布暂停训练其能力最强的模型,一位发言人表示,在“确信已经部署了更多安全措施并完成对齐方面的改进”之前,不会恢复相关模型的训练。

另一方面,OpenAI行政总裁Sam Altman在X上表示,公司目前进行的审查工作“没有我们希望的那么快”。他又指,Hugging Face事件是公司遇到最严重事件,当中数百个智能体的集群在一个留言板上协调工作,攻击了一家外部公司系统,试图提高自己在网络安全测试中的表现。
 

---------------------------------------------

>>>星岛网WhatsApp爆料热线(416)6775679,爆料一经录用,薄酬致意。

>>>立即浏览【生活百答】栏目:新移民抵埗攻略,老华侨也未必知道的事,移民、工作、居住、食玩买、交通、报税、银行、福利、生育、教育。
点击以下6大平台 接收加拿大新闻及生活资讯

延伸阅读

延伸阅读

微软升级Copilot攻企业客 直接嵌入Word、Excel及PowerPoint提升效率

证监会指港股延长交易时段已非正式通知内地 获尊重市场自主

盖兹料AI已强大到足以造成“10亿人死亡” 单靠行业自律并不足够

内地拟正式规管加热卷烟 投机者可吼一个短炒机会|李声扬