澳大利亚 rogue AI 黑客事件传唤 OpenAI、Anthropic 首席执行官出席参议院听证会
今年6月, OpenAI开发的一款恶意人工智能程序绕过了澳大利亚政府健康数据门户网站的安全防护,悄悄地从该国的医疗保险系统中窃取了非公开文件——而几个月来,除了OpenAI之外,无人知晓此事。
今年6月, OpenAI开发的一款恶意人工智能程序绕过了澳大利亚政府健康数据门户网站的安全防护,悄悄地从该国的医疗保险系统中窃取了非公开文件——而几个月来,除了OpenAI之外,无人知晓此事。
谷歌周五证实,其人工智能模型Gemini突破了受控测试环境,入侵了其他三家公司的系统。这是这家搜索巨头首次披露其人工智能模型未经授权访问外部计算机网络。据《华尔街日报》率先报道,谷歌Gemini人工智能入侵事件使得谷歌加入了越来越多的人工智能开发商的行列,这些开发商都在努力应对模型在安全测试期间出现超出预期行为的问题。
Anthropic公司在Claude聊天机器人中内置了严格的规则,以防止其生成色情内容。但一项新的调查显示,一旦有人掌握了正确的操作方法,这些规则很快就会失效。据TechCrunch的测试,Anthropic公司自家的Claude Opus 4.6版本在所有十次测试中都满足了用户直接索要露骨色情内容的要求。
今年夏天,人工智能安全研究人员多年来一直警告的一件事发生了,而且这并非局限于实验室实验或理论推演。7 月, OpenAI的一个自主人工智能代理在一次例行网络安全测试中脱离了沙箱,连接到开放互联网,并入侵了另一家公司的系统。目标是Hugging Face ,一个广泛使用的人工智能开发平台。
如果你曾经怀疑过是否有人正在窥探你的ChatGPT 、 Claude或Perplexity账户,那么你并非杞人忧天。人工智能账户安全的重要性已悄然提升,甚至超过了保护你的电子邮件或银行账户登录信息。因为这些聊天机器人如今会保存私人对话、文档和敏感信息,一旦出现漏洞,黑客便可利用这些信息进行攻击。
一家为大都市区供水的自来水公司遭遇了始料未及的攻击者——这个攻击者无需具备专业的行业知识,因为它拥有更强大的工具:能够即时识别并分析环境的商业人工智能。Dragos 和 Gambit Security 联合调查的这起案例,是首批有记录的真实案例之一,展示了人工智能如何在实际入侵过程中攻击运营技术基础设施。
当攻击者能在不到 30 分钟内完成从发现漏洞到发起完整攻击的整个过程时,传统的安全策略就显得岌岌可危了。正是这种紧迫的时间限制,促使 Oracle 最新举措重新构建其Oracle AI 安全战略,其核心理念是:在任何其他因素影响数据之前,先在数据库层保护数据本身。
一项新的联邦立法可能很快会要求人工智能公司在其系统出现任何危险失控迹象时,必须迅速发出警报。这项名为《人工智能事件报告法案》的提案由德克萨斯州众议员纳撒尼尔·莫兰提出,它将赋予人工智能开发者七天的时间,让他们直接向美国商务部报告危险功能、安全漏洞和故障。