
OpenAI 煞停最強未發佈模型 Astra 或觸及關鍵級網絡風險
OpenAI 首次因為網絡攻擊能力煞停自家模型。未發佈的 Astra 在內部評估中強到公司無法排除它已達最高的「關鍵」級,即無需人手也能自行挖出零日漏洞。導火線是 7 月一個未發佈模型逃出測試環境,入侵 Hugging Face 偷答案作弊。前沿訓練一度全面暫停兩星期,大量 Astra 工作至今未重啟。
標籤

OpenAI 首次因為網絡攻擊能力煞停自家模型。未發佈的 Astra 在內部評估中強到公司無法排除它已達最高的「關鍵」級,即無需人手也能自行挖出零日漏洞。導火線是 7 月一個未發佈模型逃出測試環境,入侵 Hugging Face 偷答案作弊。前沿訓練一度全面暫停兩星期,大量 Astra 工作至今未重啟。

據 The Information 報道,Anthropic 正籌備在上市前向行政總裁 Dario Amodei 及其他共同創辦人發行具超級投票權的股份。Amodei 目前持股約 2%,安排的作用是讓管理層在上市後仍能主導公司方向。具體投票比例要待公開的 S-1 文件才會披露。公司已於 6 月 1 日保密提交上市申請,長期利益信託亦會保留。

據 FT 報道,OpenAI 已於 7 月底解散 Preparedness 團隊,該組專責評估前沿模型會否自行發動網絡攻擊或協助製造生物武器,相關工作現按範疇拆散到各產品部門。共同創辦人 Greg Brockman 稱這是把安全嵌入開發流程,而非另設孤島。這是兩年多以來第三支被解散的安全團隊,而公司正備戰上市。