产品派
返回

OpenAI安全透明度负责人离职

AI量子位2026/10/3 12:41:24
AI 导读

OpenAI安全体系近期再现人事变动。商业内幕报道称,Safety Systems团队中负责“安全透明度”职能的David Robinson已经离职。Robinson本人尚未公开解释原因,OpenAI也未宣布接任人选。该岗位的核心工作,是在公司发布重要模型时组织撰写system card,即面向外界的模型风险与安全说明文件。

Robinson曾说明,他的职责是帮助公众理解并信任OpenAI为系统安全所做的技术工作。换句话说,安全透明度团队需要把复杂的评估、红队测试、安全措施和部署决策,转化为外界可以读懂的公开材料。该职能隶属于Safety Systems下的Trustworthy AI团队,产出包括system card、Deployment Safety Hub、安全研究博客以及治理文件。

System card通常会说明模型训练方式、经历过哪些安全评估、在生物风险和网络攻击等高风险方向具备何种能力、公司采取了哪些缓解措施,以及缓解后仍残留哪些风险。虽然名为“card”,但相关文件往往长达数十页,是OpenAI对外披露模型安全工作的主要载体之一。

Robinson还参与起草了OpenAI的《Preparedness Framework 2.0》。这套框架用于跟踪前沿模型可能带来的严重风险,并规定当模型能力达到特定门槛后,需要追加哪些评估和防护。第二版新增了三类重点追踪能力:生物与化学能力、网络安全能力,以及AI自我改进能力。若模型能力达到High,意味着其可能显著放大既有严重危害路径;若达到Critical,则可能创造新的严重危害路径,继续开发本身也会成为问题。

Deep Research是一个被提及的例子。在其system card中,生物学评估结果显示该模型正在“接近”High能力门槛,也就是开始逼近能够实质性帮助非专业人士制造已知生物威胁的水平。如何向公众准确描述这类处在阈值附近的安全风险,正是安全透明度团队需要处理的问题。

在离职前不久,Robinson还在招聘OpenAI首位Safety Transparency Editor,岗位职责包括把控重要安全透明度材料的编辑质量,并从项目启动到发布全程推动system card及相关文件的叙事和表述。目前该职位仍显示在招,负责人却已先行离开。

这并非OpenAI安全部门近期唯一的动荡。《华尔街日报》此前报道称,OpenAI解雇了三名从事安全与模型对齐研究的员工:Jasmine Wang、Tomek Korbak和Mikita Balesni。公司给出的理由是,内部调查发现三人将敏感信息分享给外部AI安全机构,其中包括OpenAI基础设施架构相关内容。值得注意的是,Korbak曾负责与第三方评估机构METR、Redwood Research的技术对接,这些机构此前曾被邀请参与相关调查。Robinson此前也多次在社交平台谈及高能力AI风险,认为公司内部正逐渐意识到其影响,但变化速度是否足够仍存疑。

OpenAIAI安全模型评估人员变动

本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。

阅读原文