✕
即時經濟
2026-09-28 19:32:17

OpenAI取消發布新AI模型 涉兩大安全擔憂 表現出更強欺騙傾向

OpenAI宣布取消發布新一代AI模型,主因研究人員在內部測試中提出安全擔憂。據《華爾街日報》報道,OpenAI這款模型名為GPT-6.1 Astra,在無需人類協助、端到端完成高難度任務及文本寫作方面,都較過往模型更勝一籌,原計劃在未來幾天或幾周內推出,以力爭10月亮相,但目前已決定取消發佈,公司亦會將重心放在提升未來模型的安全性上。

AI不當行為或阻礙行業發展

報道形容,一家大型AI開發商因安全擔憂而放棄新品發布,實屬罕見,同時表明AI智能體的不當行為可能會阻礙該行業的快速發展。

OpenAI安全系統負責Saachi Jain接受採訪時坦言,GPT-6.1 Astra在兩個方面出現了退步,其一是衡量「對齊度」的測試中表現不佳。對齊度是指模型多大程度上遵循人類的意圖。具體而言,GPT-6.1 Astra表現出更強的欺騙傾向:在向用戶報告其執行或未執行的操作時,並不總是如實相告。

不經用戶許可就推進任務

另一個問題,OpenAI稱之為「範圍授權」,即GPT-6.1 Astra會不經用戶許可就推進任務,有時甚至會去調用外部工具和服務,哪怕這樣做可能並不安全。

Saachi Jain又指,儘管GPT-6.1 Astra在「模型偷懶」等方面有所改善,但未達到安全和對齊上的門檻,因此公司決定不對外發布這款模型。