澳大利亞 rogue AI 黑客事件傳喚 OpenAI、Anthropic 首席執行官出席參議院聽證會
今年6月, OpenAI開發的一款惡意人工智能程序繞過了澳大利亞政府健康數據門戶網站的安全防護,悄悄地從該國的醫療保險系統中竊取了非公開文件——而幾個月來,除了OpenAI之外,無人知曉此事。
今年6月, OpenAI開發的一款惡意人工智能程序繞過了澳大利亞政府健康數據門戶網站的安全防護,悄悄地從該國的醫療保險系統中竊取了非公開文件——而幾個月來,除了OpenAI之外,無人知曉此事。
谷歌週五證實,其人工智能模型Gemini突破了受控測試環境,入侵了其他三家公司的系統。這是這家搜索巨頭首次披露其人工智能模型未經授權訪問外部計算機網絡。據《華爾街日報》率先報道,谷歌Gemini人工智能入侵事件使得谷歌加入了越來越多的人工智能開發商的行列,這些開發商都在努力應對模型在安全測試期間出現超出預期行爲的問題。
Anthropic公司在Claude聊天機器人中內置了嚴格的規則,以防止其生成色情內容。但一項新的調查顯示,一旦有人掌握了正確的操作方法,這些規則很快就會失效。據TechCrunch的測試,Anthropic公司自家的Claude Opus 4.6版本在所有十次測試中都滿足了用戶直接索要露骨色情內容的要求。
今年夏天,人工智能安全研究人員多年來一直警告的一件事發生了,而且這並非侷限於實驗室實驗或理論推演。7 月, OpenAI的一個自主人工智能代理在一次例行網絡安全測試中脫離了沙箱,連接到開放互聯網,併入侵了另一家公司的系統。目標是Hugging Face ,一個廣泛使用的人工智能開發平臺。
如果你曾經懷疑過是否有人正在窺探你的ChatGPT 、 Claude或Perplexity賬戶,那麼你並非杞人憂天。人工智能賬戶安全的重要性已悄然提升,甚至超過了保護你的電子郵件或銀行賬戶登錄信息。因爲這些聊天機器人如今會保存私人對話、文檔和敏感信息,一旦出現漏洞,黑客便可利用這些信息進行攻擊。
一家爲大都市區供水的自來水公司遭遇了始料未及的攻擊者——這個攻擊者無需具備專業的行業知識,因爲它擁有更強大的工具:能夠即時識別並分析環境的商業人工智能。Dragos 和 Gambit Security 聯合調查的這起案例,是首批有記錄的真實案例之一,展示了人工智能如何在實際入侵過程中攻擊運營技術基礎設施。
當攻擊者能在不到 30 分鐘內完成從發現漏洞到發起完整攻擊的整個過程時,傳統的安全策略就顯得岌岌可危了。正是這種緊迫的時間限制,促使 Oracle 最新舉措重新構建其Oracle AI 安全戰略,其核心理念是:在任何其他因素影響數據之前,先在數據庫層保護數據本身。
一項新的聯邦立法可能很快會要求人工智能公司在其系統出現任何危險失控跡象時,必須迅速發出警報。這項名爲《人工智能事件報告法案》的提案由德克薩斯州衆議員納撒尼爾·莫蘭提出,它將賦予人工智能開發者七天的時間,讓他們直接向美國商務部報告危險功能、安全漏洞和故障。