2026 年 9 月 29 日,美國眾議院議長 Mike Johnson 在議長辦公室網站發布〈Speaker Johnson Addresses Press Following Meeting with President Trump, Super Intelligence Industry Leaders〉,說明白宮會晤後簽署的 AI 安全自律協議。這場會面把幾家前沿 AI 公司的安全承諾寫在同一份文件上;值得追問的是,外部審查會得到多少權限,以及讀者何時能看到結果。

以下先看 Johnson 說了什麼、簽署文件究竟承諾了什麼,再用既有自願承諾的經驗檢驗它的可信度。這份文件能建立審查的起點,但簽名本身無法證明制度已運作。
議長的主張:讓企業先承擔安全責任
Johnson 把這場會面描述為創新、國際競爭與安全之間尋找平衡。他認為技術變化快,國會難以形成共識,業界領袖因此應先提出可行標準;白宮與國會則會繼續評估後續角色。他在談話中強調這些承諾的性質:
commitments that are voluntary on behalf of the industry.
中文:這是由產業自願作出的承諾。
Mike Johnson,2026 年 9 月 29 日公開談話
他口中的「內部控制、內外部審查」是政策方向,不是第三方已完成檢驗的報告。要看清 AI 安全自律協議 的分量,仍須讀那份實際簽署的文本。
簽署文本:四層控制,從模型到董事會
總統在原始發文公開的〈White House Accord on Super Intelligence: Joint Commitment on Frontier Responsibilities〉,把對象界定為訓練及部署前沿模型的公司,提出四層控制:訓練及部署期間監測資安、生物與化學風險等能力;由內部團隊檢查控制是否運作並處理問題;與外部獨立稽核者或評估者合作;由獨立董事會委員會接收報告並監督修正。

Partner with an independent external auditor or evaluator
中文:與獨立外部稽核者或評估者合作。
Joint Commitment on Frontier Responsibilities,第 3 項
簽名頁列出 Donald Trump,以及 Google 的 Sundar Pichai、Anthropic 的 Dario Amodei、Meta 的 Mark Zuckerberg、OpenAI 的 Greg Brockman、xAI 的 Elon Musk、Nvidia 的 Jensen Huang。名單橫跨模型開發與晶片供應,但承諾所述的具體模型、稽核範圍與適用方式,仍要看各公司後續如何公開落實。

先例提醒:自願承諾的難題是可驗證性
白宮與 AI 公司已有類似先例。2023 年的自願承諾也提到內外部測試、安全措施與透明度。2025 年,Wang 等研究者依企業的公開披露,評估 16 家公司對 2023 年承諾的回應,平均約得 53%;研究原文指出不同公司與項目差異很大。這是對可見披露資料的評分,不能當成所有公司實際安全水準只有 53%,也不能預測本次協議必然失敗。
美國 NIST 的 AI 風險管理框架指出,獨立審查有助減少內部偏差,但有用的評估還需明確的測量方法、紀錄與持續追蹤。這也是本次承諾最值得往下問的地方:外部評估者能接觸哪些模型與資料?誰決定測試項目?問題被發現後,會如何修正並向外界說明?
我同意建立四層責任;仍要等待可核對的證據
我同意把安全責任從單一工程團隊延伸到內部監督、外部評估與董事會。這讓「安全」有機會成為能分工、能追蹤的工作,而非發表會上的一句口號。外部評估也可能讓彼此競爭的公司採用較可比較的測試做法。
我存疑的是程序承諾與實際約束之間的距離。截至 2026 年 10 月 2 日,這份公開簽署文本提出「應」設置四層控制,也說參與公司「將」定期會面;讀者還須等到各公司公布評估範圍、獨立性、發現的問題與修正紀錄,才能判斷制度有沒有發揮作用。文本本身也把立法留給未來:
Over time, it may make sense to codify these steps into laws or regulations.
中文:日後或許適合把這些步驟寫入法律或規章。
Joint Commitment on Frontier Responsibilities,結語
這句話承認目前的協議與有法律效力的規則是兩回事。對使用 AI 的企業與讀者,較實用的判斷方式是追蹤每家公司之後交出的證據,而非把簽署日當成安全驗收日。若想看具體事故如何暴露通知與治理的缺口,可對照 AlphaLab 的OpenAI 使用者圖片外傳事件與澳洲 Medicare 入口事件。
接下來看三個公開訊號
- 評估範圍:受測模型、版本、危害類型與部署階段是否具體列出。
- 外部權限:評估者能否接觸足夠材料、提出不利結論,並說明利益衝突如何處理。
- 修正閉環:問題、處置期限、複測結果與董事會回應是否留下可供外界核對的紀錄。
這三項若逐步公開,AI 安全自律協議 才會從共識文件變成可檢驗的治理安排;若始終只有簽名,讀者就只能確認各方表達了意願。
接著閱讀
左右滑動查看更多推薦






