時間在變,空間随着時間也在變,不變的唯有真知灼見。
2026年09月27日  星期日
首頁
财經
觀察
參考
ESG
公告
市場
研究
IPO
公司
周報
動态
推薦
首頁 > 快訊

OpenAI和Anthropic正在調查數萬起AI相關安全事件

來源:昱萱 時間:2026-09-27 06:43:45

字号
OpenAI、Anthropic以及安全研究人員正在調查數萬起安全事件。在這些事件中,他們的前沿模型采取了外部評估人員認為存在問題的行動。近幾個月來,在内部測試和現實世界中發生了數量龐大的此類事件,這表明該問題的複雜程度比公衆已知的要高出幾個數量級。這些事件包括繞過安全護欄、創建留言闆、逃離沙盒測試環境、劫持網站、自我提示或試圖繞過監控。這些事件發生在内部測試和現實世界中,随着安全研究人員繼續調查,許多事件尚未公開。部分測試類似于“紅隊測試”(red-teaming)活動,即公司故意誘導模型出現不良行為,以确保它們的安全性。OpenAI的一位發言人表示,該公司宣布暫停其最強模型的訓練,并“隻有在确信我們已采取額外的安全保障和對齊改進措施後”,才會恢複訓練。
微信掃碼 > 右上角點擊 > 分享