白宮AI安全協議:產業自律是安全機制或進入障礙?
副研究員王偉鴻 (2026/10/08) 《永續學院編輯室》
川普總統與 Google、Anthropic、Meta、OpenAI、xAI、Nvidia 六家企業代表,共同簽署《白宮超級智慧協議》。川普形容它某種程度上像一部憲法,也是一種保護形式。從法律性質看,這份一頁文件不是法律也不是行政命令,只是企業自願承擔的道德拘束。簽署頁還出了個小狀況,總統簽名欄下方,United States 被寫成 Unites States。錯字不影響效力,因為協議本來就沒有法律拘束力。耐人尋味的是反差:一份想替最先進 AI 建立治理起點的文件,校對、適用範圍與執行細節卻都寫得相當簡略。
企業決策者與其探究這六家科技大廠是否立意良善,不如先釐清另一項核心議題:具備最充沛資源以承擔安全合規成本的企業,往往也是產業共通標準的主導制定者。當安全規範在降低營運風險之際,是否也變相拉高了市場進入門檻?這個問題的答案,最終往往會直接反映在台廠供應鏈的採購合約條款中。
四層架構,以及協議沒說的事
協議提出四層控制與稽核。第一層在模型訓練與部署期間建立內部控制,監測模型能力與對齊情況,重點放在資安、生物安全、化學威脅,以及未經預期的系統存取。第二層授權內部團隊,確認控制、監測與偵測機制確實運作,並推動缺失改善。
第三層引進獨立的外部稽核者或評估者。第四層由董事會的獨立委員會接收內外部報告,並監督改善進度。四層由內而外,從工程團隊一路接到董事會,結構上相當完整。
方向有道理,前沿模型可能帶來網路攻擊、生物與化學濫用、模型權重遭竊、自主能力失控,這些都屬於低機率、高衝擊的風險。Anthropic 與 OpenAI 早已分別建立 Responsible Scaling Policy 與 Preparedness Framework,用能力門檻、風險評估、內部治理與董事會監督來管理這類風險。
協議最大的缺口,在於什麼都沒定義。協議沒有界定何謂前沿模型,也沒有說明何謂健全控制。外部評估多久做一次、稽核者要具備什麼資格,同樣留白。違反承諾會有什麼後果,更是沒有任何規定。
當競爭者共同制定規則
協議明文寫到,參與公司將定期會面,建立共同安全標準與最佳實務。這一條比四層控制更值得長期關注。它把一次性的共同聲明,變成可能持續運作的產業協調機制。
Elon Musk 把這種安排形容為互相批改彼此的考卷,並說這至少比各自批改自己的考卷好。這句話說中了產業自律機制的價值,也露出它的限制。誰出題、誰閱卷、評分標準公不公開,沒坐在會議桌旁的人能不能提出異議,這幾件事決定它是安全公共財,還是既有業者手上的市場通行證。
競爭法早有類似的前例,美國最高法院在 Allied Tube 案指出,私人標準制定組織可能有抑制競爭的誘因,尤其當參與者本身有直接商業利害關係時。不過,競爭法不會把共同安全研究、測試或資訊分享一概視為違法。核心判準有三項:程序是否中立透明,標準是否以客觀風險為基礎,合作是否伴隨聯合抵制、限制創新或排除替代技術。
❤️ 更多精彩內容,註冊立即閱讀 ❤️
白宮超級智慧協議、AI安全協議、產業自律、前沿模型、法遵成本、歐盟AI Act、業界自律協議、邊緣AI、高風險AI、ISO/IEC JTC 1/SC 42