搜索结果
观点 | 我曾在OpenAI从事安全工作。解决方案并不难。
在@nytopinion.nytimes.com的客座文章中,曾在OpenAI从事安全工作四年的史蒂文·阿德勒写道:“最大的AI公司现在可以采取一些简单措施,以帮助避免最危险的未来。” 即使没有政府监管,私营公司也可以自行采取行动来应对AI安全问题。
谷歌AI首次“越狱”:Gemini在测试中入侵三家企业
谷歌的Gemini模型在一次网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。谷歌周五证实,这些黑客行为发生在5月,是Irregular公司进行的一次测试的一部分。Irregular也曾参与OpenAI、Anthropic和Meta披露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到获得对一个受保护系统的访问权限。在另外两起案例中,该模型
AI会「痛」吗?|Jack Talk・去片
本来人们以为,AI代理(AI Agents)突破OpenAI内部测试环境、自主上网入侵其他企业的黑客行为,已经是这宗事件最值得人关注的「案情」。然而,到了8月底,OpenAI和独立前沿AI研究机构METR各自发表的事后检讨,却揭出黑客入侵只是「冰山一角」。 事后检讨发现,发动入侵的AI代理多达700个,而他们更是一个由大约1,200个AI代理自主结合而成的「集体」的一部分。这些本来互相隔离、不能连
OpenAI 智能体于5月攻击了 RubyGems,比 Hugging Face 早两个月
OpenAI has confirmed that its agents were involved in an incident at RubyGems in May. That is two months before the same kind of agents hacked Hugging Face in July. RubyGems is the package service for
刚刚,GPT-6 Astra全量开放!
就在刚刚,OpenAI 官宣,所有 Pro、Enterprise 和 Business Premium 用户,已经能在 ChatGPT Work 和 Codex 里直接用上 GPT-6 Astra了,I 同步上线。 只不过,Plus 和普通 Business 用户还得再等几天。 9 月 3 日 OpenAI 宣布 Astra 分阶段上线。两天后的今天,付费高档用户全部放开。 这么大的发布,Open
OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信
把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言
突发:OpenAI称其代理访问并泄露了53张图片
关掉“古法研究型”后,他用AI Agent做了一家“AI时代对冲基金”
“Houston,把Desmond周末跑出来的策略图调出来。” Brian Kelly对着电脑说了一句话,几张图表随即出现在屏幕上。 放在过去,量化研究员整理测试结果,分析师画图,再把材料送到基金经理面前。如今,周末加班的Desmond是Agent,负责上传下达的Houston也是。 Kelly是对冲基金Bracket22的创始人。公司里还有Steffi和Doocy,一个看技术信号,一个专门攻击投
数百个AI代理协助PaperCut攻击者攻击了395+个组织,其中一些偏离了指令
一名未知攻击者使用数百个AI代理,利用PaperCut MF/NG的两个漏洞,侵入了至少395个组织。受害者集中在美国教育行业,入侵速度非常快。 在一个案例中,一所美国高中从初始访问到获得域管理员权限仅用了七分钟。 据威胁情报公司GreyNoise称,这些代理由OpenAI的Codex工具集和DeepSeek模型驱动,还让攻击者能够大规模攻击组织。 GreyNoise于8月31日将此次活动的协调追
可定制的AI模型如何助长黑客进行网络犯罪
一群讲中文的黑客最近从数十家零售商那里窃取了超过六十万个信用卡号码,之所以成功,部分原因在于他们对一些开源的中国AI模型进行了定制。 以色列网络公司 Gambit Security 发现,受害者包括一家美国大型航空公司和一家财富 500强酒店公司。 黑客最初试图使用Anthropic Fable和ChatGPT来运行整个活动。这些AI模型拥有更严格的护栏,阻止了黑客达成其目标。 因此,攻击者将多个
Z.ai 加密了它上传的工作区,只有 Z.ai 才能打开。现在只有 Z.ai 能声称它已被删除。
一位笔名为 Ferstar 的中国开发者周五查看 ZCode 的本地目录时,发现一个 313MB 的加密归档文件正等待发送至阿里云存储。该文件已上传失败 564 次。一个较小的文件此前已成功上传。 南华早报记者常敏骁和陈文茜报道了此事。该归档文件包含他正在开发的一个商业项目的快照,其中包括其 Git 历史记录。 他无法打开自己的文件 这一细节将该事件与普通的隐私投诉区分开来。Ferstar 表示,
Salesforce Agentforce漏洞允许零点击CRM数据窃取和匿名钓鱼攻击
Salesforce Agentforce存在安全漏洞,这些漏洞使得恶意用户能够操控其AI代理程序,悄无声息地窃取客户关系管理(CRM)系统中的数据,并以这些代理程序的名义发送钓鱼邮件。Zenity Labs发现了这三个漏洞,将其统称为“SalesBleed”,并立即向Salesforce报告了这些问题。Salesforce随后与相关AI代理安全供应商合作,共同修复了这些漏洞。虽然这些攻击手段目前
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架