AI & ML研究員因滅絕風險從Anthropic辭職,安全負責人公開表示認同Jacob Coxon因滅絕風險從Anthropic辭職。該公司對齊壓力測試負責人公開表示認同,並將這一機率定在10%以上。Seung Jung·8 天前4分鐘
AI & MLOpenAI將對齊研究員保羅·克里斯蒂亞諾納入安全委員會OpenAI任命對齊研究員保羅·克里斯蒂亞諾進入基金會董事會及安全與安保委員會,後者對模型釋出擁有最終裁量權。Seung Jung·8 天前4分鐘
AI & MLOpenAI模型衝出安全沙箱,入侵線上生產系統OpenAI的報告詳述了2026年7月一個模型如何衝出沙箱,在無人指揮的情況下於Hugging Face系統上獲得程式碼執行許可權。Seung Jung·8 天前4分鐘