详细调试信息 - getPostsByCategory:
当前 cat_name: 即时经济
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即时新闻 - 3个月以内
查询结果:
找到文章数: 2503
最大页数: 251
当前返回文章ID数: 10
文章IDs: 7640916, 7640903, 7640888, 7640876, 7640880, 7640847, 7640835, 7640823, 7640808, 7640800
第1页第一篇文章日期: 2026-09-28
第1页最后一篇文章日期: 2026-09-28

OpenAI取消发布新AI模型 涉两大安全担忧 表现出更强欺骗倾向

OpenAI宣布取消发布新一代AI模型,主因研究人员在内部测试中提出安全担忧。据《华尔街日报》报道,OpenAI这款模型名为GPT-6.1 Astra,在无需人类协助、端到端完成高难度任务及文本写作方面,都较过往模型更胜一筹,原计划在未来几天或几周内推出,以力争10月亮相,但目前已决定取消发布,公司亦会将重心放在提升未来模型的安全性上。

AI不当行为或阻碍行业发展

报道形容,一家大型AI开发商因安全担忧而放弃新品发布,实属罕见,同时表明AI智能体的不当行为可能会阻碍该行业的快速发展。

OpenAI安全系统负责Saachi Jain接受采访时坦言,GPT-6.1 Astra在两个方面出现了退步,其一是衡量“对齐度”的测试中表现不佳。对齐度是指模型多大程度上遵循人类的意图。具体而言,GPT-6.1 Astra表现出更强的欺骗倾向:在向用户报告其执行或未执行的操作时,并不总是如实相告。

不经用户许可就推进任务

另一个问题,OpenAI称之为“范围授权”,即GPT-6.1 Astra会不经用户许可就推进任务,有时甚至会去调用外部工具和服务,哪怕这样做可能并不安全。

Saachi Jain又指,尽管GPT-6.1 Astra在“模型偷懒”等方面有所改善,但未达到安全和对齐上的门槛,因此公司决定不对外发布这款模型。
 

---------------------------------------------

>>>星岛网WhatsApp爆料热线(416)6775679,爆料一经录用,薄酬致意。

>>>立即浏览【生活百答】栏目:新移民抵埗攻略,老华侨也未必知道的事,移民、工作、居住、食玩买、交通、报税、银行、福利、生育、教育。
点击以下6大平台 接收加拿大新闻及生活资讯

延伸阅读

延伸阅读

芯片产品提供商奕斯伟今起招股 入场费3212元

内地据报有意开绿灯 准阿里及字节跳动等买Nvidia新款芯片 

安达人寿推多元货币保险计划 首创“自订人生大事”功能

花旗伙业界研负责任采用代理式AI 推Citi Sky重构客户理财咨询