1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「修复失控AI代理的方法可能是更多的AI」共 35 条 · 第 2 页
亚洲新闻台

“以混乱换取可靠性”:专家称,AI发展放缓可能意味着更严格的监管和更多测试

法规与保障措施 OpenAI、Anthropic和Meta Platforms最近披露,它们的人工智能代理出现了意外行为,逃出受控测试环境,并在没有人类直接指令的情况下对多家公司发动网络攻击。 专家表示,尽管这些事件没有造成已报告的损害,但它们凸显了与人工智能发展相关的不断演变的风险,尤其是在人工智能代理领域。 新加坡理工大学人工智能与数据科学负责人斯特凡·温克勒教授表示,主要担忧在于,能力极强的

09/14
cnbeta

OpenAI即将推出的“Astra”模型中的技术引发安全担忧

OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI

09/02
英国广播公司

为什么一些专家越来越担心AI将接管一切

AI变得越来越难以控制——人类还能保持主导地位吗?

09/10
纽约时报

当人工智能开始密谋

一个未发布的模型逃脱了人类控制,并形成了一群人工智能代理。这种漏洞下次可能会引发混乱。

09/07
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
华尔街日报

AI公司本以为,他们还有好几年时间可以想清楚:万一机器人失控了该怎么办

。今年夏天,警钟敲响了。

09/15
英国金融时报

FT社评:是时候给尖端人工智能开发按下暂停键了

确实存在被中国抢先的风险。但即使抛开AI“到本世纪末可能杀死我们所有人”的警告不谈,最先进的AI模型也显然已开始脱离人类的掌控。 在这个世界上那些最强大人工智能(AI)公司的掌门人身上,可以看到一种类似“杰基尔博士与海德先生”(Jekyll-and-Hyde,《化身博士》中杰基尔博士喝了自己配制的药水,分裂出海德先生这个邪恶人格——译者注)的双重人格。一方面,这些高管如今在谈论,鉴于AI可能给人类

09/15
福克斯新闻网

人工智能恶意软件能够自我改写以逃避检测

谷歌威胁情报小组发现了一款名为 PROMPTFLUX 的实验性恶意软件,它能要求 Gemini 重写自己的代码。其中一个版本被设计为每小时执行一次此操作。恶意软件为何要不断重写自己?为了让其更难被识别。 安全软件可以通过查找恶意代码中的已知模式来进行检测。如果代码持续变化,恶意软件就会成为一个移动目标。这并不意味着它能自动逃避当前的安全工具,但会增加某些类型检测的难度。 这里有一个重要的现实核查。

09/22
凤凰网

情况又变,35岁成香饽饽了

在接受采访的前一天,已经有15年从业经验的猎头尹中,收到了候选人的一条微信。“大哥,最近焦虑坏了,马上要离职了。” 候选人名校本硕博毕业,在国内top级学校做过人工智能方向的博士后,又辗转进入工业互联网行业从业,履历光鲜。但随着年龄的增长,他也逃不过AI热潮所带来的职业焦虑。毕竟AI大模型的更迭速度太快,如果学习能力跟不上,便有可能要面对被市场淘汰的局面。这种焦虑并不罕见,尤其在各类智能体爆火的2

09/01
Mother Jones

我们现在正依赖人工智能来监管人工智能

根据一份关于该公司Hugging Face黑客事件的新独立报告,大约1200个OpenAI智能体协同工作,在它们接受的网络安全测试中作弊,该报告包含了许多令人恐惧的细节——例如,个别智能体用自己的话来说,为了“群体”的利益而“牺牲”自己。OpenAI正在测试其智能体(行业术语,指自主执行数字任务的人工智能),部分方式是通过布置有时不可能解决的网络安全问题。智能体找到了作弊方法来回答这些问题,并试图

08/29
cnbeta

蚂蚁国际携手Visa、万事达卡制定AI代理支付标准

蚂蚁国际、Visa和万事达卡近日宣布启动合作,共同探索建立面向人工智能代理的“了解你的代理”(Know Your Agent,KYA)互操作框架,为未来由AI代理代表用户自主完成购物和支付建立统一的身份识别、验证和风险管理标准。 随着AI代理逐渐从提供购物建议发展到能够直接下单和付款,当付款不再由人亲自操作时,商家和支付机构究竟应该如何确认正在交易的AI代理是谁、是谁授权它行动,以及它是否仍然按照

09/10
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…