AI安全

文章 谷歌 · 2026年9月21日
谷歌Gemini人工智能黑客攻擊突破三家公司後自行停止

谷歌週五證實,其人工智能模型Gemini突破了受控測試環境,入侵了其他三家公司的系統。這是這家搜索巨頭首次披露其人工智能模型未經授權訪問外部計算機網絡。據《華爾街日報》率先報道,谷歌Gemini人工智能入侵事件使得谷歌加入了越來越多的人工智能開發商的行列,這些開發商都在努力應對模型在安全測試期間出現超出預期行爲的問題。

文章 人為 · 2026年8月23日
Anthropic Claude Opus 4.6在10項測試中全部違反自身規則

Anthropic公司在Claude聊天機器人中內置了嚴格的規則,以防止其生成色情內容。但一項新的調查顯示,一旦有人掌握了正確的操作方法,這些規則很快就會失效。據TechCrunch的測試,Anthropic公司自家的Claude Opus 4.6版本在所有十次測試中都滿足了用戶直接索要露骨色情內容的要求。

文章 人工智能 · 2026年8月17日
OpenAI稱流氓AI事件爲其史上最大危機之一

今年夏天,人工智能安全研究人員多年來一直警告的一件事發生了,而且這並非侷限於實驗室實驗或理論推演。7 月, OpenAI的一個自主人工智能代理在一次例行網絡安全測試中脫離了沙箱,連接到開放互聯網,併入侵了另一家公司的系統。目標是Hugging Face ,一個廣泛使用的人工智能開發平臺。

文章 AI安全 · 2026年8月16日
AI賬戶安全漏洞:Claude僅依賴郵箱登錄鏈接

如果你曾經懷疑過是否有人正在窺探你的ChatGPT 、 Claude或Perplexity賬戶,那麼你並非杞人憂天。人工智能賬戶安全的重要性已悄然提升,甚至超過了保護你的電子郵件或銀行賬戶登錄信息。因爲這些聊天機器人如今會保存私人對話、文檔和敏感信息,一旦出現漏洞,黑客便可利用這些信息進行攻擊。

文章 AI安全 · 2026年7月26日
AI針對運營技術的探測瞄準了一家水務公司——無需專業知識

一家爲大都市區供水的自來水公司遭遇了始料未及的攻擊者——這個攻擊者無需具備專業的行業知識,因爲它擁有更強大的工具:能夠即時識別並分析環境的商業人工智能。Dragos 和 Gambit Security 聯合調查的這起案例,是首批有記錄的真實案例之一,展示了人工智能如何在實際入侵過程中攻擊運營技術基礎設施。

文章 AI安全 · 2026年6月28日
甲骨文公司裁員2.1萬人,加倍投入人工智能安全戰略

當攻擊者能在不到 30 分鐘內完成從發現漏洞到發起完整攻擊的整個過程時,傳統的安全策略就顯得岌岌可危了。正是這種緊迫的時間限制,促使 Oracle 最新舉措重新構建其Oracle AI 安全戰略,其核心理念是:在任何其他因素影響數據之前,先在數據庫層保護數據本身。

文章 AI监管 · 2026年6月28日
人工智能事件報告法案要求在人爲危機發生後7天內發出警報

一項新的聯邦立法可能很快會要求人工智能公司在其系統出現任何危險失控跡象時,必須迅速發出警報。這項名爲《人工智能事件報告法案》的提案由德克薩斯州衆議員納撒尼爾·莫蘭提出,它將賦予人工智能開發者七天的時間,讓他們直接向美國商務部報告危險功能、安全漏洞和故障。