OpenAI 任命 RLHF 先驅 Paul Christiano 加入安全監督委員會

新聞摘要
OpenAI 已任命長期以來不斷警告先進人工智慧可能帶來災難性風險的研究員 Paul Christiano,加入其非營利基金會董事會,以及負責監督全公司模型發布決策的安全委員會。此項人事消息於 2026 年 9 月 9 日(太平洋時間)公布,讓這位該領域中最受矚目的風險倡議者之一,進入這家打造全球最強大 AI 系統公司的治理架構之中。
Paul Christiano 是誰
Christiano 最為人熟知的身分是基於人類回饋的強化學習(RLHF)的共同開發者;這項訓練技術正是現代大型語言模型得以遵循指令、並產出有用且行為合宜回應的基礎。他於 2017 年至 2021 年間任職於 OpenAI,期間主導對齊研究工作,隨後離開並創立 Alignment Research Center(ARC),這是一家致力於開發理論與實證工具、以確保先進 AI 系統與人類意圖保持一致的非營利組織。
離開 OpenAI 後,Christiano 也接下了政府顧問職務。他在隸屬於美國國家標準與技術研究院(NIST)的 AI 標準與創新中心(CAISI)擔任資深技術顧問,參與評估前沿 AI 模型在安全相關能力上的表現。根據 OpenAI 的說法,這段經歷橫跨兩屆政府任期,讓他得以從結合技術研究與政策及標準制定的角度,掌握 AI 安全的整體脈絡。
在 OpenAI 的新職務
根據此次任命,Christiano 將加入 OpenAI 基金會董事會,更具體地說,是加入其安全委員會(SSC),與委員會主席、卡內基美隆大學教授 Zico Kolter 共事。SSC 負責監督 OpenAI(包括公益公司 OpenAI Group)各項安全與資安實務的治理工作,並有權在新前沿模型向公眾發布前,審查並核准其準備狀態。
Christiano 在 OpenAI Group PBC 董事會中的職位為無表決權觀察員。OpenAI 表示,他以顧問身分參與時,會迴避與其 CAISI 政府工作相關的議題與模型評估;這樣的安排旨在避免他在公部門與私部門角色之間產生利益衝突。
為何這項任命備受矚目
這項任命之所以引人注目,是因為 Christiano 一直直言不諱地指出 AI 發展速度所帶來的風險規模。在隨公告發布的聲明中,他寫道,自己現在認為「AI 能力的快速提升,極有可能在非常近的未來導致災難性且不可逆的失控風險」,而且他不認為整個 AI 產業(包括 OpenAI 在內)目前正朝著將該風險降至可接受水準的方向前進。他補充說,自己之所以選擇加入,是因為相信如果 OpenAI 「能挺身而出應對挑戰」,就能實質降低這項風險。
OpenAI 基金會董事會主席 Bret Taylor 將這項任命定位為強化獨立監督的一環。他表示,Christiano 「透過嚴謹且聚焦於日益強大系統所提出最艱難問題的研究,協助定義了 AI 對齊這個領域」,而他在前沿 AI 安全與政府標準制定方面的經驗,將同時強化董事會的監督力道與委員會的工作。Christiano 本人則指出,「過去一年來 AI 能力進展極為迅速,而對齊仍是一項困難的技術難題」,這也突顯出為何他認為委員會肩負的責任如今比以往任何時候都更加重要。
OpenAI 治理架構的背景
此舉發生在 OpenAI 於 2025 年進行組織重組之後;該次重組將原本的非營利基金會與新成立的公益公司 OpenAI Group 分開,目的是在商業實體之上保留一層非營利使命與安全監督機制。安全委員會原本的成員已包括 Zico Kolter、Adam D'Angelo、Sue Desmond-Hellmann、Paul M. Nakasone 與 Nicole Seligman 等人,以及執行長 Sam Altman。如今加入一位以強調生存級風險著稱的研究員,進一步擴大了該委員會的觀點多元性——畢竟對於新模型是否足夠安全可以推出,該委員會擁有最終發言權。
更廣泛的產業背景
Christiano 的任命正值 AI 安全治理議題在整個科技業受到廣泛關注之際。2026 年,關於強大 AI 系統進展速度有多快、以及安全研究能否跟得上腳步的公開辯論,已在整個產業中升溫,多個實驗室的研究員紛紛發表關於對齊、可解釋性與風險控管的研究成果。透過將一位兼具深厚技術對齊背景與政府標準制定經驗的研究員納入正式監督角色,OpenAI 釋出了一個訊號:它希望自身的安全治理能納入那些願意公開指出現行產業做法仍不足夠的聲音,而不只是採納抱持較樂觀時程看法的人。
對於關注 AI 安全領域的學生與觀察者而言,這項任命提供了一個具體範例,說明對齊研究如何從昔日的小眾學術追求,走向企業治理的核心;如今,研究如何讓 AI 系統保持可預測與可控的研究員,已經坐上了決定新模型何時準備好問世的董事會席位。