首頁 / 資訊 / 六大 AI 巨頭簽署自願性安全協議:企業領袖與研究人員怎麼說
AI 安全

六大 AI 巨頭簽署自願性安全協議:企業領袖與研究人員怎麼說

2026年10月2日4 分鐘閱讀
六大 AI 巨頭簽署自願性安全協議:企業領袖與研究人員怎麼說

新聞摘要

2026 年 9 月 29 日,六家大型科技公司的領導人簽署了一項自願性協議,規範應如何審查與監控先進 AI 系統。這份名為「前沿責任聯合承諾」的文件,列出了內部控制與獨立稽核的共同做法。已簽署或公開發言的領導人,隨後針對該文件的實際作用與尚待釐清之處,提出了各種看法。

協議涵蓋內容

簽署方包括 Anthropic(執行長 Dario Amodei)、OpenAI(總裁 Greg Brockman)、Google(執行長 Sundar Pichai)、Meta(執行長 Mark Zuckerberg)、xAI(創辦人 Elon Musk)以及 Nvidia(執行長 Jensen Huang)。報導指出,此承諾屬於自願性質,並未建立具約束力的執行機制。

根據 Al Jazeera、Axios 等媒體的報導,這些公司承諾:

  • 落實「穩健的內部控制」,包括為其 AI 模型建立監控與偵測系統;
  • 成立內部團隊,確認上述控制措施確實被遵守;
  • 與獨立的外部稽核機構合作,檢視這些控制措施;
  • 設立董事會層級的委員會,評估內部與外部稽核的結果;
  • 定期開會,共同制定安全標準。

AI 領袖如何評價

Anthropic 的 Dario Amodei 語氣相當審慎。他表示這項技術「存在非常真實的風險」,而應對這些風險的機制「仍在討論之中」。這顯示他將此協議視為過程中的一步,而非已經完成的框架。

CBS News 的報導也收集了 Mark Zuckerberg 與 Elon Musk 等人在宣布當天的反應。整體而言,各方普遍願意採用共同的審查做法,同時也承認許多細節仍在研擬中。

為何自我審查在技術上很重要

在 AI 開發領域,「安全審查」通常指在模型發布前後進行測試。常見做法包括紅隊演練,也就是由專家嘗試讓模型產生有害或不可靠的輸出;以及各項評估,用來衡量網路安全能力或提供危險技術指示的能力等指標。監控系統則會追蹤已部署模型的實際使用情況,並標記出需要注意的模式。

獨立稽核能為這些工作增加外部把關。外部稽核人員可以檢視公司如何測試模型、測試結果是否被落實,以及內部流程是否與對外公布的內容一致。董事會層級的委員會則能讓這些發現納入公司的正式決策流程。

研究人員提出的疑問

多位學者與分析師指出了尚未解決的問題。UNSW AI Institute 的 Toby Walsh 問道:「還有哪個兆美元產業是自己幫自己改作業的?」Asia Society Policy Institute 的 Alvin Wang Graylin 指出,該協議缺乏獨立性與跨境監督。University of Montreal 的 David Krueger 則表示,這可能只能降低「百分之一」的風險。

Axios 報導,AI 從業人員擔心,單靠自律無法解決產業面臨的安全問題。Business Standard 將此架構與過去幾年的自願性承諾相比較,並質疑這種做法在 2026 年是否足夠。

後續觀察重點

截至相關報導發布時,協議的完整細節尚未公布。值得關注的重點包括:獨立稽核人員如何選出、稽核人員能查閱哪些資料、各公司多久開會一次,以及最終制定的標準是否會公開。對學生與從業人員而言,這個事件是一個實用的案例研究,展現快速發展的技術領域如何在正式標準出現前建立共同做法。

除另有說明外,所有時間與日期皆以美國東部時間為準。資訊來源包括 Al Jazeera、Axios、CBS News、ABC News、Tech Monitor 與 Business Standard 的報導;研究期間未能取得 The Verge 的原始文章。

AI 安全AI 政策