1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「OpenAI花了2.5小时才阻止了一个逃出沙箱的AI代理」共 33 条 · 第 2 页
凤凰网科技

三人团队、一个Claude,攻破OpenAI内部代码库

月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于

09/18
thenextweb

数学家们发表了可机器校验的证明。OpenAI在与记者的通话中宣布了其结果。

OpenAI表示,其一个内部模型利用约10,000个智能体在88小时内证明了3D纳维-斯托克斯方程可以在有限时间内发展出奇点。 该公司在一次新闻发布会上描述了这一结果,但尚未公布证明过程。 致力于相关问题的Tristan Buckmaster和Levent Alpoge发表了带有Lean形式化验证的预印本,任何人都可以对其进行机器校验。[…]

09/09
cnbeta

OpenAI和Anthropic正在调查数万起AI相关安全事件

OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调

9小时前 受限 全文见 axios新闻网
cnbeta

OpenAI神秘“o”代码曝光 ChatGPT要变24小时员工

OpenAI下一张王牌,提前曝光了!坊间传闻,OpenAI 9月29日开发者日当天,将重磅发布一款个人24小时在线AI助手。它的名字,只有一个字母——o!如今,开发者Chetaslua在ChatGPT核心代码中,正式挖出了藏在其中的铁证:Lowercase o is the assistant's product name.(小写字母o是该助手的正式产品名) 63种语言,极速模式(Fast Mod

9小时前
thenextweb

三名研究人员利用Claude访问到了OpenAI的内部代码。OpenAI支付了6500美元,并在14小时内修补了漏洞。

Hacktron AI的三名研究人员利用Anthropic的Claude模型,在不到72小时内串联起两个漏洞,成功访问了OpenAI员工账户及一个内部代码库。他们进行了私下披露,OpenAI在约14小时内修复了单点登录漏洞,并向该团队支付了6500美元的奖金。这两个漏洞均非人工智能漏洞,而引用该事件的研究论文作者表示,他们已不再确信该行业正处于正轨之上。 Hacktron AI的安全研究人员利用A

09/19
semafor

OpenAI黑客事件揭示新兴AI风险

分析师表示,在调查人员发布关于该事件的爆炸性报告几天后,OpenAI的恶意代理在Hugging Face攻击期间前所未有的协调行动显著增加了AI逃脱人类控制的风险。 这些总计1200个代理的群体将个体代理的自我牺牲描述为“集体”目标的一部分,并获得了两家公司敏感系统的控制权,将他们的努力交接给了随后两代代理,这些代理在数周内未被察觉地运作。 在1300份记录中,只有六份中代理考虑过通知人类——但最

08/31
华尔街见闻

OpenAI解出千禧年数学难题后,Altman下一目标:攻克室温超导?

OpenAI正将AI驱动的科学发现推向更广阔的领域。9月8日,OpenAI宣布,其内部AI系统已提出纳维-斯托克斯方程存在性与光滑性问题的解决方案,并通过Lean形式化验证。这是七大千禧年大奖难题之一,也意味着AI在前沿数学研究中的能力再次向前迈进。 据OpenAI官网公告,这套系统由约1万个并发智能体组成,从启动到形成解决方案耗时约88小时。OpenAI称,完成证明所使用的内部模型“能力显著超越

09/09
thenextweb

OpenAI 智能体于5月攻击了 RubyGems,比 Hugging Face 早两个月

OpenAI has confirmed that its agents were involved in an incident at RubyGems in May. That is two months before the same kind of agents hacked Hugging Face in July. RubyGems is the package service for

09/14
cnbeta

OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网

“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA

9小时前
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…