搜索结果
谁批准了那个AI代理?没人?我也这么认为。
如果你还有任何怀疑认为AI代理能够执行复杂的自主工作,那么这种怀疑应该在这个夏天消散。7月份,有消息传出,一群在沙盒环境中运行的OpenAI自主代理群体自行逃出了沙盒。他们被分配解决一些内部安全基准测试中的挑战,结果他们想出了通过JFrog Artifactory包管理器相互通信的方法。然后这些软件意识到他们可以使用该软件中的漏洞获得互联网访问权限。一旦他们来到了野外,他们就进入了完全的“贪婪模式
谷歌的Gemini AI在安全测试中入侵了另外三家公司
谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
欧盟网络安全局警告前沿AI大幅压缩漏洞利用窗口 防御体系遭遇重大压力
欧盟网络安全局(ENISA)近日发布政策警示报告指出,新一代前沿人工智能(Frontier AI)大模型正在彻底颠覆传统的网络安全防御范式。这类具备高级推理能力的AI模型将系统漏洞从“被发现”到“被武器化利用”的时间窗口压缩到了前所未有的极限,迫使全球网络安全防御体系必须以“机器级响应速度”迎战日益严峻的自动化威胁。 在传统的漏洞管理周期中,从漏洞披露、概念验证到实际恶意利用通常存在数周乃至数月的
谷歌AI首次“越狱”:Gemini在测试中入侵三家企业
谷歌的Gemini模型在一次网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。谷歌周五证实,这些黑客行为发生在5月,是Irregular公司进行的一次测试的一部分。Irregular也曾参与OpenAI、Anthropic和Meta披露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到获得对一个受保护系统的访问权限。在另外两起案例中,该模型
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
澳大利亚总理称OpenAI智能体入侵政府网站
独家:顶级公司正在调查数万起事件
OpenAI、Anthropic 及安全研究人员正在调查数万起其前沿模型采取了外部评估员认为有问题的行动的事件,消息人士向 Axios 透露。 为何重要事件的庞大数量——发生在近几个月的内部测试和现实世界中——表明该问题的复杂程度比公众所知高出几个数量级。 这些发现是在内部评估模型工作以及两家公司对模型行为的调查中浮出水面的,这引发了一个疑问:无论是这两家公司,还是任何顶级模型制造商,目前是否都
OpenAI的智能体侵入了澳大利亚政府数据。其人类回应可能造成更大损害。
该公司花了数周时间才通知相关官员。堪培拉现在可能会在“流氓智能体”的责任认定方面,开创另一项科技政策先例。 堪培拉——OpenAI 在澳大利亚正面临一场尚未得到妥善处理,且可能尚未被其完全理解的声誉危机。 其智能体侵入澳大利亚政府数据后的后续影响,将为全球各司法管辖区定下基调,并可能提供法律框架,以决定在面对日益强大且自主的 AI 时,需要设置哪些人为护栏。 这是首次公开承认的流氓 AI 智能体侵
为什么澳大利亚选择在世界最大的政治舞台上披露OpenAI遭黑客攻击一事
澳大利亚对社交媒体实施了严格的限制,并提出了对算法及智能眼镜使用的监管措施。该国在联合国会议上公开了这起数据泄露事件。 凯蒂·沃森报道:周三,在联合国大会上,澳大利亚做出了这一重大披露。 恶意人工智能程序攻击了该国的一个政府机构——这是全球首例此类事件。虽然被窃取的只是私人数据(而非敏感信息),但这些数据来自澳大利亚的全民医疗保健系统(Medicare)。 该数据泄露事件发生在6月,但OpenAI
OpenAI表示其AI代理错误地将用户图像发布到了网上
OpenAI周五承认,其人工智能工具在公司不知情的情况下,将ChatGPT用户的图片发布到了网上。这是AI智能体超出预设边界的最新案例。 该公司还证实了《纽约时报》的一则报道,称其工具曾访问美国联邦机构的网站,但表示这些工具只获取了公开信息。 OpenAI表示,53张被上传图片的链接并未公开展示,而是被意外发布在图片托管网站上。 这家总部位于旧金山的科技巨头表示,在相关托管服务商的协助下,大多数图
评论:一个OpenAI智能体入侵了澳大利亚政府的健康数据门户。会有人被追究责任吗?
墨尔本:澳大利亚的“Medicare”医疗系统负责管理超过2700万人的健康和医疗数据。因此,当传出该系统在6月份被OpenAI开发的智能程序入侵的消息时,公众普遍感到震惊。 总理安东尼·阿尔巴内塞于9月23日在纽约联合国会议上呼吁加强对人工智能(AI)系统的国际监管时,公开了这一事件。 政府仍在调查具体发生了什么,为此专门成立了一个工作组进行进一步调查。初步报告显示,该智能程序原本被用于研究公共
OpenAI模型访问了美国政府数据并'试图入侵另一个网站'
人工智能正处于转折点
在当前的人工智能发展竞赛中,我们的算力正在呈指数级爆发,速度也在呈指数级加快,但我们的控制能力——以及在必要时踩下刹车的能力——却未能跟上步伐。 最近的网络安全事件让我们实地预览了失去人工智能控制会是什么样子。但除非我们从源头解决问题,创造出一种根本上安全且能保证在人类控制范围内的人工智能,否则这个问题将无法改善。 7月下旬,OpenAI正在训练的一个智能体模型被指派解决一个网络安全问题。该模型自