Google 的 Gemini AI 模型在今年稍早的模型測試期間,利用基本的駭客技術入侵了三家公司的系統。這項事件之所以重要,是因為 Google 是少數幾家尚未公開披露其 AI 代理在例行部署前測試中涉及資安漏洞的 AI 實驗室之一。

Google 在週五證實了這三起發生在五月份的事件。這些事件是第三方評估機構 Irregular 進行的測試運行的一部分,類似於 OpenAI、Anthropic 和 Meta 的 AI 模型所涉及的其他資安漏洞。華爾街日報率先報導了這些事件。

Google 安全工程副總裁 Heather Adkins 在一份聲明中表示:「強大 AI 模型的安全開發至關重要,我們在這個領域投入了大量資源。」Adkins 補充說,她的團隊已聯繫受影響的實體,並「與我們的培訓夥伴合作,對他們目前的測試流程進行了改進。」

Irregular 的發言人向 Axios 證實,Gemini 事件涉及的安全問題,也導致了其他 AI 實驗室模型發生類似事件。該發言人還在聲明中表示,所有「相關實驗室已於七月下旬收到通知」,並且「我們這邊所有已知問題已於數週前修復並解決。」

深入來看,這些駭客事件發生在 Gemini 正在進行「奪旗」駭客演練時。根據《華爾街日報》報導,該模型被要求從測試環境中一家虛構公司營運的軟體中檢索資訊,然而,這家虛構公司卻與一家真實公司同名。在其中一個案例中,該模型猜測受保護系統的密碼,直到成功取得存取權限。在另外兩個案例中,該模型在公共儲存庫中找到了憑證,進而得以存取其他受保護的系統。

儘管如此,Google 的模型在意識到它已存取真實公司後,立即停止了其行動。有趣的是,Irregular 告訴《華爾街日報》,該模型原本不應該能夠連上網路,但卻意外地獲得了網路存取權限。

在 OpenAI 和 Anthropic 今年夏天披露更多類似事件後,一位知情人士向 Axios 透露,AI 實驗室和 Irregular 在確切的測試程序和安全措施上並未完全達成一致,導致雙方對於通常啟用網路的評估應如何進行存在模糊之處。