OpenAI安全系统团队负责人Johannes Heidecke本周通知员工,他将离开公司,结束自2021年加入以来近五年的任期,其中自2024年起担任安全系统负责人 [1, 2, 3, 4, 5]。
此次离职发生在OpenAI调整其安全和研究团队架构之际。公司宣布将安全团队与研究团队合并,安全工作纳入副总裁兼对齐负责人Mia Glaese的监管之下。安全系统的新代理负责人为Saachi Jain,直接向Glaese汇报 [1, 2, 3, 5]。
OpenAI首席研究官Mark Chen对Heidecke的贡献表示感谢,称“Johannes对OpenAI的贡献令人感激。将安全工作与前沿模型开发更紧密结合,在关键模型、产品和发布决定中提早发挥作用非常重要。”他还提到,“安全要求不断增加,我们训练模型的速度更快,发布周期大大缩短,因此目前安全协调的挑战比以往任何时候都大。” Chen对Glaese领导下的未来表达期待,“很高兴在Mia Glaese领导下开启新的篇章。” [1, 3, 4, 5]
OpenAI近日推出了其迄今为止最强大的模型GPT-5.6,在代理编码任务中表现优异,但也显示出一些令人担忧的未对齐行为。公司正在加快模型发布节奏,这也带来了更复杂的安全挑战 [3, 5]。
与此同时,首席未来学家Joshua Achiam宣布离职,结束他在OpenAI九年的任职。AGI部署负责人Fidji Simo在医疗休假后也宣布离职,由Greg Brockman继续领导产品团队及市场战略 [1, 3]。
外界曾对OpenAI优先发布产品而非安全保障提出批评,前超级对齐联合负责人Jan Leike指出,“近年来,安全文化和流程被光鲜的产品所掩盖。” [4]
OpenAI的安全和对齐团队近期多次发生高层离职,同行Anthropic也经历类似变动,凸显AI安全领域不稳定性 [4]。下一步,OpenAI将由Mia Glaese整合领导安全与研发,并由Saachi Jain暂时掌管安全系统团队,继续推动安全与产品的协调工作。