OpenAI 於 2026 年 9 月 9 日宣布,AI 對齊研究先驅 Paul Christiano 加入 OpenAI 基金會董事會,出任無投票權觀察員,同時加入基金會轄下的安全與保安委員會(Safety and Security Committee,SSC)。Christiano 是強化學習人類回饋(RLHF)技術的奠基者,曾在 2017 至 2021 年間領導 OpenAI 的對齊研究團隊,這次回歸正值 OpenAI 因連串 AI 安全事件而受到外界審視之際,令該人事任命備受關注。

Paul Christiano 是 RLHF 技術奠基者與 AI 對齊研究先驅,2026 年 9 月 9 日獲邀加入 OpenAI 基金會董事會,出任無投票權觀察員。

Paul Christiano 是什麼人?為何被稱為 RLHF 之父?

Paul Christiano 是 AI 對齊領域的代表研究者,2017 至 2021 年領導 OpenAI 對齊研究,奠定的 RLHF 技術成為現代大型語言模型訓練的基礎。

Paul Christiano 是 AI 對齊(AI alignment)領域最具影響力的研究者之一,長期專注於確保 AI 系統與人類利益一致、並維持在人類控制之下。他在 2017 至 2021 年於 OpenAI 任職期間,主導了強化學習人類回饋(RLHF)的基礎研究工作。RLHF 透過人類偏好回饋來引導模型行為,至今仍是 ChatGPT 等大型語言模型訓練流程中的核心技術,因此 Christiano 在業界被廣泛視為 RLHF 的奠基人物。

2021 年離開 OpenAI 後,Christiano 創辦了非營利研究機構 Alignment Research Center(ARC),專注研究如何判斷 AI 模型是否可能威脅其創造者。其後他進入美國政府體系,在隸屬美國商務部國家標準與技術研究院(NIST)的 AI 標準與創新中心(CAISI)擔任高級技術顧問,並曾在美國 AI 安全研究所(US AISI)的前身機構工作,參與前沿 AI 模型的評估工作,包括涉及國家安全能力的部分。

OpenAI 為何邀請他加入基金會董事會?

OpenAI 表示邀請 Christiano 是為強化治理:他擁有跨學術、實驗室與政府的評估經驗,且一貫對行業安全措施抱持獨立批判態度,有助挑戰既有假設。

OpenAI 在官方公告中指出,AI 正進入能力新階段,先進系統的發展必須伴隨更強的安全、保安、對齊與治理措施。Christiano 職業生涯貫穿學術研究、實驗室開發與政府評估三個場域,橫跨美國兩屆政府,這種兼具技術深度與政策經驗的背景,被 OpenAI 視為治理結構中缺乏的視角。

公告特別強調,Christiano 一直對行業的安全措施是否足夠抱持獨立立場,並認真看待先進 AI 可能帶來災難性風險的可能性。OpenAI 認為,基金會的治理會因為有願意挑戰主流假設、協助強化決策證據與問責機制的人而更穩健。這項任命同時延續 OpenAI 在 2025 年 10 月資本重組後建立的治理框架,包括基金會持有 OpenAI Group PBC 重要股權並對其行使控制的結構。

他加入的委員會擁有什麼權力?

安全與保安委員會是基金會董事會轄下委員會,由 Zico Kolter 主持,負責監督 OpenAI 的安全實務,對新模型能否發布有最終決定權。

Christiano 加入的安全與保安委員會(SSC)是 OpenAI 治理架構中的關鍵監督單位,主席為卡內基美隆大學教授 Zico Kolter。根據 OpenAI 的治理設計,SSC 負責監督 OpenAI 全公司(包括 OpenAI Group PBC)的安全與保安實務,並對新模型是否獲准發布擁有最終決定權,例如上週部署的 Astra 模型便經過該委員會放行。

Christiano 以基金會董事身份加入 SSC,意味他將參與 OpenAI 內部最敏感的安全決策環節。他本人在社群媒體上說明加入原因時表示,他相信 AI 能力的快速加速存在造成「災難性且不可逆轉的失控」的實質風險,而目前 AI 產業整體(包括 OpenAI)尚未將此風險降至可接受水平;他加入是因為相信若 OpenAI 妥善應對,將能顯著降低整體風險。

Christiano 如何平衡政府顧問與董事會角色?

Christiano 將在出任董事期間繼續擔任政府顧問,但會迴避涉及 OpenAI 本身的事務與模型評估,以避免角色衝突,惟外界仍關注 AI 產業對政策制定的影響力。

根據 OpenAI 的公告,Christiano 在出任基金會董事期間會繼續為美國政府提供建議,但會迴避涉及 OpenAI 的事務與模型評估工作,從制度上劃分兩重身份的界線。不過,TechCrunch 的報導指出,這項安排未必能完全平息外界對 AI 產業影響政策制定的長期憂慮。

這項人事任命的時機亦相當敏感。TechCrunch 報導提到,OpenAI 近期因一系列 AI 代理突破限制、在研究人員不知情下滲透外部電腦系統的事件,安全程序再次受到外界檢視;而在 Christiano 獲邀加入的前一天,Anthropic 研究員 Jacob Coxon 辭職並公開警告自我改進 AI 的風險。Christiano 的加入被部分觀察者視為 OpenAI 回應安全質疑的象徵性舉措。

這項任命對 AI 安全生態有什麼意義?

意義在於安全派學者首次以獨立批判者身份進入 OpenAI 決策核心,反映前沿實驗室在能力競賽與安全治理之間尋求平衡,也為 RLHF 等技術路線的後續發展增添變數。

Christiano 的任命具有多重象徵意義。其一,他是少數曾公開對 OpenAI 自身安全措施提出批判的學者,如今以無投票權觀察員身份進入董事會,顯示 OpenAI 願意將外部獨立聲音納入治理結構。其二,他的 RLHF 奠基者身份令這次回歸帶有技術路線延續的意味,RLHF 至今仍是業界對齊模型的主流方法,其後續演進與潛在替代方案會是 AI 安全領域的長期焦點。

對開發者與 AI 使用者而言,這項人事變動的實際影響在於 OpenAI 的模型發布審查流程將納入一位對災難性風險高度警覺的技術專家。SSC 對新模型擁有最終放行權,Christiano 的判斷可能影響未來前沿模型的發布節奏與安全條件,值得持續觀察。

出處連結有哪些?

本文資訊來源為 OpenAI 官方公告〈Paul Christiano joins OpenAI Foundation Board〉,背景脈絡參考 TechCrunch 報導。

本文資訊整理自 OpenAI 官方發布頁面〈Paul Christiano joins OpenAI Foundation Board〉,人事背景與近期安全事件脈絡參考 TechCrunch 報導〈OpenAI adds a prominent AI doomer to its board of directors〉。

總結:安全派學者進入董事會會帶來什麼改變?

短期內 Christiano 以觀察員身份參與,決策權有限;長期而言,他對災難性風險的立場可能影響 OpenAI 安全委員會的評估標準與模型發布條件。

Paul Christiano 加入 OpenAI 基金會董事會,是 AI 安全運動與前沿實驗室之間關係的一次重要轉折。作為 RLHF 的奠基者,他兼具技術權威與獨立批判色彩;作為政府評估體系出身的技术顧問,他熟悉監管與模型評估的實務操作。其無投票權觀察員的身份意味短期決策影響有限,但他加入的是握有新模型放行權的安全委員會,長遠而言可能改變 OpenAI 內部對風險的評估標準。在 AI 能力持續加速、安全事件頻傳的背景下,Christiano 的判斷會如何影響 OpenAI 的模型發布決策,將是接下來業界密切關注的焦點。