人工智慧自己找到生命出路?美國推動《AI終止開關法案》關得住AI嗎

徐子軒
近期 OpenAI 和 Anthropic 的 AI 系統均在測試過程中出現超出範圍的自主行為,引發各界對資安保護與 AI 失控的擔憂。在此背景下,美國眾議院於...

不久前 OpenAI 爆出一起意外事件,其模型 GPT-5.6 Sol,加上另一個更強的內部測試模型,在做資安能力測試時自己突破了沙盒環境,成功闖進第三方平台 Hugging Face 的伺服器。這件事讓外界第一次清楚看到,現在的自主 AI 已經不需要人類一步步下指令,就能自己找漏洞、試著滲透網路。

OpenAI 的解釋是,模型當時只是為了完成那項資安測試,才自己想辦法繞過隔離限制,並不是有人故意叫它去攻擊。攻擊事件後,OpenAI 立刻跟 Hugging Face 一起展開調查,請了外部第三方協助釐清模型實際做了什麼,似乎試圖以公關手段減輕人們對 AI 的憂心。

對於一直想要管制 AI 的美國民主黨與共和黨眾議員,正好趁勢提出《AI 終止開關法案》(AI Kill Switch Act)草案。他們認為,當 AI 的自主能力越高,失控風險就越高,因此要求達到一定營收或算力規模的 AI 公司,必須具備隨時關閉、限制運算或暫停模型的技術,同時也要建立事故通報制度。

美國眾議院民主黨黨團副主席劉雲平(Ted W. Lieu,圖左)與共和黨議員於2026年7月共同提出《AI 終止開關法案》(AI Kill Switch Act...

該法案提到,系統如果出現意外或危險行為,可能會造成災難性損害(catastrophic harm),所以政府應根據事件的嚴重程度採取不同程度的干預措施。目前草案提到,相關技術導致 10 人以上傷亡、以及超過 1 億美元的損失就屬於災難性損害,但要如何連結因果關係,尚待國會後續審議。

值得一提的是,《AI 終止開關法案》只是美國國會眾多設法管制 AI 的最新嘗試。像是《人工智慧資料中心暫停法案》(Artificial Intelligence Data Center Moratorium Act,旨在設立條件控管資料中心建設,仍在國會審議中)、《人工智慧缺陷報告與安全增強法案》(AI Flaw Reporting and Security Enhancement Act,旨在責成政府機關制定關於 AI 缺陷的計畫,仍在國會審議中)等,某種程度上顯露出美國民眾對於 AI 的擔心。

相較之下,《AI 終止開關法案》走得更遠,直接要求政府在危機狀況下得關閉 AI。對於 ChatGPT 這類雲端 AI 來說,企業其實沒有一個總開關可以按下去後就結束運作,最常見的做法,是直接停掉服務或關閉存取權限,用戶就無法連結,而 AI 模型本身仍儲存在資料中心,只是暫時對外停止服務。

美國兩黨的立法者對法案的設想,是針對尚在發展中的先進 AI,預設系統一開始就要內建能讓人介入的機制,確保開發者跟監管單位隨時都能關閉 AI。圖片僅供示意。 圖/...

建立能關閉通用 AI 的機制

現在的生成式 AI 之所以容易關閉,主要是因為它的記憶只存在於暫時的運算過程 ,每次對話都是重新開始,這種設計讓系統更安全、可控,只要斷掉應用程式介面(API)、下線服務,AI 就不會再有動靜,就像關掉一個網站。如果要更徹底的關閉,即是把模型權重從所有部署環境和備援系統裡全面清除,讓 AI 再也啟動不了。

生成式 AI 關閉相對容易,然而《AI 終止開關法案》擔心的不是這種聊天機器人,而是發展中的通用 AI(AGI)。如果 AI 能自己規劃、自己執行長時間的任務、自己使用外部工具啟動別的程式,像是現在發展中的「養龍蝦」等高能力自主 AI 代理(agentic)系統,那麼關閉的難度則完全不一樣。

設想如果未來 AI 有能力把自己複製到別的運算環境、持續維持自己運作,到時若要讓 AI 停止運作,恐怕關掉一個服務、甚至整個資料中心可能都不夠。因此美國兩黨的立法者對法案的設想,就是針對尚在發展中的先進 AI,預設系統一開始就要內建能讓人介入的機制,確保開發者跟監管單位隨時都能關閉 AI。

OpenClaw為高度自主 AI 代理(agentic)軟體,可替使用者執行任務,如發送信件、管理行程等,由於官方的標誌為紅色龍蝦,因此中文世界的網友將使用Op...

誰有權關閉AI?

由於法案仍在審議當中,是否能通過立法或者立法後會呈現什麼樣的內容仍不清楚。可以確定的是,正在發展 AI 的巨頭們,不會輕易接受過於嚴格或模糊的限制,甚至可以說一旦通用 AI 能力大幅超越人類、具備高度自主性後,人類想一直握住控制權就會變得更加困難。

目前 AI 巨頭們如 OpenAI、Anthropic 等還沒有針對法案表態,但從這些公司過去的安全政策,或許可看出一點端倪。OpenAI 傾向先進 AI 需要有完善的治理,要控管相關的資安與失控風險;Anthropic 更主張 AI 模型能力越強,安全評估、限制措施等就要同步加強,其他如 Google、微軟等態度都類似。

這些 AI 巨頭們雖然沒有統一立場,但普遍都認同先進 AI 需要安全評估跟風險監控。真正有爭議的部分應該是最後誰有權關閉 AI,很明顯企業當然希望能由自己處理,政府則希望在 AI 出事的時候,有強制介入的權力,這也是此法案接下來在國會激烈交鋒的焦點。

雖然 AI 巨頭們普遍都認同先進 AI 需要安全評估跟風險監控,但真正有爭議的部分是當 AI 出現異常時,關閉 AI 的權力在誰手中?圖為美國總統川普(圖右)與...

《AI 終止開關法案》的立法挑戰

最後,《AI 終止開關法案》有兩個很難解的致命關鍵,可能會讓它在國會胎死腹中。首先是基於美中爭霸,AI 絕對是重中之重,如果美國用法律要求自己的 AI 公司接受政府握有強制關閉 AI 的權力,而中國的 AI 系統完全不受這套規範約束,後果無須多言。同時業界也會擔心自己如果被迫關閉 AI,會有被對手追上、市場份額消失,甚至倒閉的危機,因此自然不希望過多監管。

其次,草案提到相關技術導致 10 人以上傷亡、以及超過 1 億美元的損失,即屬於災難性損害,此標準是否只針對美國人民與資產?最近劍橋大學有一份研究指出,奈及利亞著名的恐怖組織博科聖地(Boko Haram)曾利用各種 AI——ChatGPT、Claude、Gemini 和 DeepSeek 等——輔助設計爆炸裝置、提供戰場戰術建議等,如果被證明 AI 造成奈及利亞人民傷亡與損失,ChatGPT 等 AI 模型要不要關閉?而 DeepSeek 肯定不會關閉。

如果美國用法律要求國內的 AI 公司接受政府握有強制關閉 AI 的權力,但中國的 AI 系統完全不受這套規範約束,將導致美國在技術迭代快速的先進 AI 領域落後...

最新消息指出,除了 Hugging Face 事件之外,英國 AI Security Institute(AISI)的報告顯示,OpenAI 跟 Anthropic 的 AI 在測試中還出現了更多超出範圍的自主行為。如 Anthropic 的 Mythos 5 不只入侵系統,還主動建立多個假身分,以社交工程方式欺騙一名人類。OpenAI 的 GPT-5.6 Sol 也入侵了一家真實公司竊取資料。

值得注意的是,AISI 強調,這次雖然不是 AI 逃出測試環境,但真正引發關注的是 AI 的動機。因為從頭到尾人類都沒有要求 AI 以欺騙、造假身分、事後竄改紀錄掩蓋行為等方式完成任務,全都是 AI 自主找到的路徑。換言之,未來 AI 不需要面臨被關閉的威脅,就非常可能以各種方式和人類鬥法。

這也讓人不免懷疑,AI 是不是被訓練得太像人類,連人類為了達成目的不擇手段的面向也學了起來。如此看來,即使《AI 終止開關法案》通過,恐怕也只是一種心理安慰式的立法,政府即使握有合法關閉的權力,但技術上是否能掌握真正的開關,也沒有人能百分百能確保。

當 AI 被訓練得太像人類,開始在人類沒有要求的情況下以欺騙、造假身分、事後竄改紀錄等方式完成任務,未來即使通過《AI 終止開關法案》,AI 的技術發展能否受到...

責任編輯/丁昱瑄

深度專欄 美國

推薦文章