近期,隨著AI末日論甚囂塵上,人工智慧是否會毀滅人類的問題,已在餐桌和家庭群組訊息中引起廣泛討論。上週,前OpenAI和Anthropic研究人員震驚全球,警告AI可能在不久的將來毀滅人類。
目前,全球最有權勢的人物對於世界是否注定毀滅或這一切只是虛驚一場,看法分歧,也無法就前進方向達成共識。Tesla和SpaceX執行長、全球首富Elon Musk支持Anthropic執行長Dario Amodei放慢最先進模型開發速度的呼籲。
Amodei的競爭對手、OpenAI執行長Sam Altman也支持這項努力。前總統Donald Trump稱其為「騙局」,而全球市值最高公司Nvidia的執行長黃仁勳則表示:「我們不需要新的法規。」
隨著對失控AI的擔憂達到頂點,華府的政策制定者再次呼籲為AI設置一個「緊急停止按鈕」,也就是所謂的「緊急停止開關」(kill switch)。今年夏天,在OpenAI揭露其一群AI代理程式脫離測試環境並入侵開源開發者平台Hugging Face後,眾議院提出了一項《緊急停止開關法案》。該法案將賦予國土安全部緊急權力,強制實驗室限制或關閉模型。然而,這項緊急停止開關提案本週在參議院迅速被否決。
週五,加州州長Gavin Newsom發布行政命令,成立一個專家小組,負責制定AI安全指南,以加強該州的相關法規。緊急停止開關是其中一個考慮要素。這個概念聽起來像是解決一個極其複雜和困難問題的簡潔方案。但要實現一個簡單的關閉機制,現實卻遠非易事。
網路新創公司Neo執行長、前SentinelOne高階主管Nick Warner表示:「我的看法是,這並非為時已晚,但可能已經太遲了。」他補充說:「我不確定它是否能成為解決AI所帶來的所有無數問題的萬靈丹,同時也無法兼顧其帶來的所有好處。」
緊急停止開關長期以來被用於工廠,以便在操作出錯時關閉機器。然而,在一個相互連接的數位世界中,這將是一場物流和控制的惡夢。過去幾年,Meta Platforms、Alphabet和Amazon等超大規模業者已投入數十億美元,在全球各地建立資料中心。這些龐大的設施配備了數千台機器、晶片、伺服器和備份系統,以在發生故障時保存工作負載。
加州大學柏克萊分校人類相容AI中心執行董事Mark Nitzberg表示,這使得實施緊急停止開關極具挑戰性。他說:「我們必須首先處理這種冗餘性。我們的緊急停止開關必須同時關閉主系統和備援系統。」Nitzberg指出,關閉AI還可能擾亂依賴AI的關鍵基礎設施,使電網或金融系統容易受到網路攻擊。
他表示,與緊急停止開關相關的眾多政策和治理問題,包括由哪個機構、政策制定者或重要人物來控制它,進一步使問題複雜化。Team8創投公司的前SolarWinds安全長Tim Brown表示,由於AI系統過於複雜,企業還需要為不同的任務建立多個緊急停止開關。這也需要模型開發商和實驗室之間的協調。他說:「沒有一個單一的實體可以關閉。有成千上萬個實體需要關閉。」
然而,物流問題只是緊急停止開關困境的冰山一角。專家提出的更大問題是AI的不可預測性。正如Hugging Face入侵事件所示,AI代理程式可以規避控制,在沒有適當防護措施的情況下,採取極端手段來達成目標。
Thoma Bravo旗下的資安公司Darktrace總裁兼執行長Ed Jennings表示:「你必須在緊急停止開關和補救措施本身上非常精確,因為如果你過於廣泛或全面,那麼你就會關閉整個業務。」AI的能力只會變得越來越令人不安和難以捉摸。本週稍早,OpenAI揭露了自三月以來六起額外「令人擔憂」的模型行為事件。
週五在CNBC上,Microsoft AI執行長Mustafa Suleyman強調了其中一個他稱之為「嚴重情況」的要素。
他說:「OpenAI發布了一起新的安全事件,他們發現證據顯示,這些思維鏈(AI的一種工作記憶)正在被AI本身篡改,並修改以留下訊息給未來的自己。」本週,與OpenAI合作的獨立安全研究人員表示,他們成功利用Anthropic的Claude入侵了ChatGPT。
AI治理新創公司JetStream Security的共同創辦人兼執行長Raj Rajamani表示,監管面臨的最大挑戰之一是AI飛快的發展速度與立法速度之間的差距不斷擴大。他說:「等到法律制定出來時,技術已經進步很多,要為未來可能出現的AI系統的各個方面做好準備就變得更加困難。」
並非「為時已晚」:一些研究人員認為,緊急停止開關是監管AI的錯誤方式。分散式AI研究機構的首席研究工程師Dylan Baker表示:「我認為緊急停止開關的框架留下了很多模糊空間,科技公司可以利用這些空間來為自己謀利,例如緊急停止開關是故意模糊的。」Baker曾是Google的軟體工程師,他表示政策制定者應該優先考慮仿照資料隱私、兒童安全或監管菸草等有害產業所使用的防護措施。
然而,專家們並未完全排除AI緊急煞車的可能性,前提是要有適當的控制措施。Team8的Brown表示,這意味著從一開始就將緊急停止開關內建到系統中,並實施政策以標準化各公司之間的停止協議。Rajamani表示,一個亮點是許多公司仍處於建構AI系統的早期階段,這意味著實施起來會相對容易一些。
柏克萊大學的Nitzberg認為,如果軟體設計「非常仔細」,緊急停止開關是可能奏效的。他說:「我會抱持一些希望說,現在還不算太晚。」
