首页 / 资讯 / OpenAI 任命 RLHF 先驱 Paul Christiano 加入其安全监督委员会
AI 安全

OpenAI 任命 RLHF 先驱 Paul Christiano 加入其安全监督委员会

2026年9月10日5 分钟阅读
OpenAI 任命 RLHF 先驱 Paul Christiano 加入其安全监督委员会

新闻摘要

OpenAI 已任命长期警告高级人工智能可能带来灾难性风险的研究员 Paul Christiano 加入其非营利基金会董事会,以及负责监督全公司模型发布决策的安全与安保委员会。该公告于 2026 年 9 月 9 日(太平洋时间)发布,此举将业内最知名的风险关注者之一纳入了这家打造全球最强 AI 系统公司的治理架构之中。

Paul Christiano 是谁

Christiano 最为人熟知的身份是基于人类反馈的强化学习(RLHF)的共同开发者,这项训练技术是现代大语言模型实现对齐、遵循指令并生成有用且规范回答的基础。他曾在 2017 年至 2021 年间任职于 OpenAI,期间领导对齐研究工作,随后离职创办了对齐研究中心(ARC),这是一家致力于开发理论与实证工具、以确保高级 AI 系统与人类意图保持一致的非营利机构。

离开 OpenAI 后,Christiano 还担任了政府顾问职务。他在隶属于美国国家标准与技术研究院(NIST)的人工智能标准与创新中心(CAISI)担任高级技术顾问,参与评估前沿 AI 模型在安全相关方面的能力。据 OpenAI 介绍,这段经历横跨两届政府任期,使他能够将技术研究与政策及标准制定相结合,从而获得审视 AI 安全的独特视角。

在 OpenAI 的新职务

根据此次任命,Christiano 将加入 OpenAI 基金会董事会,更具体地说,是加入其安全与安保委员会(SSC),与该委员会主席、卡内基梅隆大学教授 Zico Kolter 共事。SSC 负责监督整个 OpenAI(包括 OpenAI Group 公益公司)的安全与安保实践治理,并有权在新前沿模型向公众发布前审查并批准其就绪状态。

Christiano 在 OpenAI Group PBC 董事会中的职位是无投票权的观察员。OpenAI 表示,作为顾问,他将回避与其在 CAISI 的政府工作相关的事项和模型评估,这一机制旨在避免其公共部门与私营部门角色之间产生利益冲突。

此次任命为何引人注目

此次任命备受关注,因为 Christiano 一直直言不讳地指出 AI 发展速度所带来的风险规模。在随公告发布的声明中,他写道,他现在认为“AI 能力的快速提升极有可能在极短期内导致灾难性且不可逆的失控”,并且他认为包括 OpenAI 在内的整个 AI 行业目前并未走上将该风险降至可接受水平的轨道。他补充说,自己之所以选择加入,是因为他相信如果 OpenAI “能够迎难而上”,公司就能切实降低这一风险。

OpenAI 基金会董事会主席 Bret Taylor 将此次任命视为独立监督力量的加强。他表示,Christiano “通过严谨且聚焦于日益强大的系统所提出的最棘手问题的工作,帮助定义了 AI 对齐领域”,而他在前沿 AI 安全和政府标准制定方面的经验将增强董事会的监督力度和委员会的工作成效。Christiano 本人则指出,“过去一年 AI 能力进步极为迅速,而对齐仍是一个艰难的技术难题”,这也凸显出为何他认为委员会的责任如今比以往任何时候都更加重大。

OpenAI 治理架构背景

此举发生在 OpenAI 2025 年的重组之后。那次重组将其最初的非营利基金会与新成立的 OpenAI Group 公益公司分离开来,目的是在商业实体之上保留非营利使命和安全监督层。安全与安保委员会此前已有 Zico Kolter、Adam D'Angelo、Sue Desmond-Hellmann、Paul M. Nakasone 和 Nicole Seligman 等成员,以及首席执行官 Sam Altman。引入一位以强调生存级风险著称的研究员,拓宽了该委员会的观点多样性——该委员会对新模型是否足够安全可以发布拥有最终决定权。

更广泛的行业背景

Christiano 的任命正值 AI 安全治理问题在整个科技行业引发广泛关注之际。2026 年,围绕强大 AI 系统进步速度之快以及安全研究能否跟上的公开讨论在全行业愈演愈烈,多家实验室的研究人员纷纷发表关于对齐、可解释性和约束控制的研究成果。通过将一位兼具深厚技术对齐资历和政府标准制定经验的研究员纳入正式监督岗位,OpenAI 释放出信号:它希望其安全治理体系能容纳那些愿意公开指出现有行业实践尚不充分的声音,而不仅仅是认同更乐观时间表的人。

对于关注 AI 安全领域的学生和观察者而言,此次任命提供了一个具体案例,说明对齐研究——曾经只是小众的学术追求——如何进入企业治理层面:研究如何让 AI 系统保持可预测和可控的研究人员,如今正坐在决定新模型何时可以面向世界发布的董事会席位上。

AI 安全OpenAI