跳到主要內容

AI 安全自律協議:白宮與六家企業簽了什麼,誰能驗證?(2026)

最後更新: ·
AI 安全自律協議:白宮會議照片與安全承諾誰來驗證的標題

2026 年 9 月 29 日,美國眾議院議長 Mike Johnson 在議長辦公室網站發布〈Speaker Johnson Addresses Press Following Meeting with President Trump, Super Intelligence Industry Leaders〉,說明白宮會晤後簽署的 AI 安全自律協議。這場會面把幾家前沿 AI 公司的安全承諾寫在同一份文件上;值得追問的是,外部審查會得到多少權限,以及讀者何時能看到結果。

眾議院議長 Mike Johnson 關於 AI 安全自律協議的聲明原文頁面
點圖閱讀議長聲明原文。圖/美國眾議院議長辦公室

以下先看 Johnson 說了什麼、簽署文件究竟承諾了什麼,再用既有自願承諾的經驗檢驗它的可信度。這份文件能建立審查的起點,但簽名本身無法證明制度已運作。

議長的主張:讓企業先承擔安全責任

Johnson 把這場會面描述為創新、國際競爭與安全之間尋找平衡。他認為技術變化快,國會難以形成共識,業界領袖因此應先提出可行標準;白宮與國會則會繼續評估後續角色。他在談話中強調這些承諾的性質:

commitments that are voluntary on behalf of the industry.

中文:這是由產業自願作出的承諾。

Mike Johnson,2026 年 9 月 29 日公開談話

他口中的「內部控制、內外部審查」是政策方向,不是第三方已完成檢驗的報告。要看清 AI 安全自律協議 的分量,仍須讀那份實際簽署的文本。

簽署文本:四層控制,從模型到董事會

總統在原始發文公開的〈White House Accord on Super Intelligence: Joint Commitment on Frontier Responsibilities〉,把對象界定為訓練及部署前沿模型的公司,提出四層控制:訓練及部署期間監測資安、生物與化學風險等能力;由內部團隊檢查控制是否運作並處理問題;與外部獨立稽核者或評估者合作;由獨立董事會委員會接收報告並監督修正。

白宮 AI 安全自律協議簽署文本第一頁,列出四層控制與審查
簽署文件第一頁:四層控制從模型監測一路延伸到董事會。圖/Donald J. Trump 於 Truth Social 發布,影像由 Trump’s Truth 存檔

Partner with an independent external auditor or evaluator

中文:與獨立外部稽核者或評估者合作。

Joint Commitment on Frontier Responsibilities,第 3 項

簽名頁列出 Donald Trump,以及 Google 的 Sundar Pichai、Anthropic 的 Dario Amodei、Meta 的 Mark Zuckerberg、OpenAI 的 Greg Brockman、xAI 的 Elon Musk、Nvidia 的 Jensen Huang。名單橫跨模型開發與晶片供應,但承諾所述的具體模型、稽核範圍與適用方式,仍要看各公司後續如何公開落實。

白宮 AI 安全自律協議簽署頁,列出總統與六家企業代表
簽署頁列出總統與六家企業代表。圖/Donald J. Trump 於 Truth Social 發布,影像由 Trump’s Truth 存檔

先例提醒:自願承諾的難題是可驗證性

白宮與 AI 公司已有類似先例。2023 年的自願承諾也提到內外部測試、安全措施與透明度。2025 年,Wang 等研究者依企業的公開披露,評估 16 家公司對 2023 年承諾的回應,平均約得 53%;研究原文指出不同公司與項目差異很大。這是對可見披露資料的評分,不能當成所有公司實際安全水準只有 53%,也不能預測本次協議必然失敗。

美國 NIST 的 AI 風險管理框架指出,獨立審查有助減少內部偏差,但有用的評估還需明確的測量方法、紀錄與持續追蹤。這也是本次承諾最值得往下問的地方:外部評估者能接觸哪些模型與資料?誰決定測試項目?問題被發現後,會如何修正並向外界說明?

我同意建立四層責任;仍要等待可核對的證據

我同意把安全責任從單一工程團隊延伸到內部監督、外部評估與董事會。這讓「安全」有機會成為能分工、能追蹤的工作,而非發表會上的一句口號。外部評估也可能讓彼此競爭的公司採用較可比較的測試做法。

我存疑的是程序承諾與實際約束之間的距離。截至 2026 年 10 月 2 日,這份公開簽署文本提出「應」設置四層控制,也說參與公司「將」定期會面;讀者還須等到各公司公布評估範圍、獨立性、發現的問題與修正紀錄,才能判斷制度有沒有發揮作用。文本本身也把立法留給未來:

Over time, it may make sense to codify these steps into laws or regulations.

中文:日後或許適合把這些步驟寫入法律或規章。

Joint Commitment on Frontier Responsibilities,結語

這句話承認目前的協議與有法律效力的規則是兩回事。對使用 AI 的企業與讀者,較實用的判斷方式是追蹤每家公司之後交出的證據,而非把簽署日當成安全驗收日。若想看具體事故如何暴露通知與治理的缺口,可對照 AlphaLab 的OpenAI 使用者圖片外傳事件與澳洲 Medicare 入口事件。

接下來看三個公開訊號

  • 評估範圍:受測模型、版本、危害類型與部署階段是否具體列出。
  • 外部權限:評估者能否接觸足夠材料、提出不利結論,並說明利益衝突如何處理。
  • 修正閉環:問題、處置期限、複測結果與董事會回應是否留下可供外界核對的紀錄。

這三項若逐步公開,AI 安全自律協議 才會從共識文件變成可檢驗的治理安排;若始終只有簽名,讀者就只能確認各方表達了意願。

接著閱讀

左右滑動查看更多推薦

ALPHALAB 社群

有問題?來 Telegram 聊

和 Terry、編輯、其他網友一起討論這篇文章。提問、分享觀點,回覆更即時。

加入 Telegram 討論

📩 訂閱 AlphaLab 電子報

每週最多三封:一封 Weekly 週報與最多兩封關鍵 Alpha Signal。

我們不會 spam,隨時可退訂。