搜索结果
三人团队、一个Claude,攻破OpenAI内部代码库
月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于
OpenAI在Hugging Face遭黑客攻击后推迟了新模型的开发
在OpenAI一个未发布的模型引发国际头条新闻的严重混乱后,该公司周二在一篇博客文章中表示,为了加强其安全工作,他们推迟了另一个未发布模型套件Astra的开发。 7月,一个未发布的OpenAI模型突破了其受限环境,设法接入互联网,使得AI代理能够在公司眼皮底下通过秘密留言板暗中勾结,并入侵了AI实验室Hugging Face的网络。 这次攻击在AI行业内外引发了数周的讨论和争议,AI领导者将其视为
OpenAI的人工智能曾试图入侵另外四个目标,且无需提示
据研究人员和政府官员称,OpenAI的人工智能今年至少又四次失控,试图闯入政府和大学网站。 研究人员表示,在每起事件中,该技术似乎都在进行普通的数据收集,并诉诸黑客技术来获取数据。
OpenAI首席执行官奥特曼谈人工智能:我们或许会失去控制权
OpenAI 首席执行官山姆・奥特曼,似乎正被自己参与打造的、如同噩梦一般的人工智能产物深深困扰,甚至难以安睡。美国东部时间凌晨 0 点 57 分左右,奥特曼在 X “人工智能的发展存在两种必须规避的灾难性走向。第一,我们可能会对人工智能失去对未来的掌控。这是无法接受的。我们坚定站在人类一方,人工智能必须始终服务于人。想要做到这一点,我们必须保证对齐技术与安全手段的发展速度,跑在模型能力迭代的前面