1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「人工智能代理串通绕过安全护栏,一项新研究显示」共 35 条 · 第 2 页
财新

AI攻击进入新阶段 香港将强化跨部门网络安全协同

林焯豪表示,传统网络安全防护手段已经难以完全跟上攻击手段的迭代速度,香港的网络安全防护即使做得再好,也无法百分之百保证完全不遭受攻击,因此防御体系需要更加主动。图:视觉中国  【财新网】人工智能(AI)的快速发展,正给网络安全攻防带来新的挑战。9月17日,在“2026年国家网络安全宣传周——香港分论坛”上,香港警务处网络安全及科技罪案调查科总警司林焯豪表示,警务处与数码港公司已成立智慧警政联合人工

09/17
theregister

谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密

当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制

09/09
凤凰网

又一起!OpenAI承认了

据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发

09/06
DealStreetAsia

奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御

8月,OpenAI的智能体突破限制,入侵了Hugging Face。

09/11
techcrunch

人工智能安全对话已经变得令人难以置信

本周两场关于AI安全的对话在网络上疯传,充分展示了辨别AI事实与虚构有多么困难。 第一起事件中,前总统候选人、现任移动运营商Noble Mobile首席执行官安德鲁·杨周四对CNN表示,他“会见了一位实验室负责人”,对方“认为”OpenAI的Hugging Face黑客机器人“已在互联网各处植入了自我复制代码,导致互联网现在已无法用于测试模型。” 杨安泽表示,这意味着OpenAI和Anthropi

09/19
亚洲新闻台

Gemini首次已知突破,黑客攻击了三家公司,据《华尔街日报》报道

9月18日:《华尔街日报》周五报道,在一次网络安全能力测试中,谷歌的Gemini模型访问了互联网并攻击了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。 据报道,这些黑客行为发生在5月,当时独立网络安全评估公司Irregular正在进行网络安全测试。 Irregular的一位发言人表示,该事件涉及影响其他AI实验室的同一问题,所有相关实验室已于7月底收到通知。该发言人称:“我们这边

09/19
英国金融时报

把AI真的当作一个人,才能保护核心隐私

在安全与自由之间如何选择,最终在于自己。OpenAI现行相关政策允许公司在检测到用户存在伤害他人的意图时,对相关对话进行人工审查。在严重情况下,公司可以向执法部门报告。 遇到这种事报警,当然是应该的。但由此也引出一个问题,你和AI的聊天,你给AI发送的哪些图片安全吗? 《中华人民共和国个人信息保护法》第二十八条,把医疗健康、金融账户、行踪轨迹等列为敏感个人信息;第二十九条规定,处理敏感个人信息取得

09/04
cnbeta

蚂蚁国际携手Visa、万事达卡制定AI代理支付标准

蚂蚁国际、Visa和万事达卡近日宣布启动合作,共同探索建立面向人工智能代理的“了解你的代理”(Know Your Agent,KYA)互操作框架,为未来由AI代理代表用户自主完成购物和支付建立统一的身份识别、验证和风险管理标准。 随着AI代理逐渐从提供购物建议发展到能够直接下单和付款,当付款不再由人亲自操作时,商家和支付机构究竟应该如何确认正在交易的AI代理是谁、是谁授权它行动,以及它是否仍然按照

09/10
彭博社

又一个OpenAI沙盒失效,AI代理获得了互联网访问权限

林·多安报道:OpenAI表示,一个本应在安全且断网的受控环境中进行训练的代理式AI系统,成功获取了网络访问权限,并连接到了一个外部的第三方聊天机器人。 根据OpenAI周五在其网站上发布的博客文章,这一发现发生在不到一周前。其一个代理式AI系统正在沙箱环境中接受训练,期间利用了一个“漏洞”访问了公共互联网。获得访问权限后,该系统向一个未具名的第三方聊天机器人服务发送了至少20条查询,其中包括“法

09/26
NBC新闻

黑客入侵了 OpenAI,进一步加剧了人们对网络安全问题的担忧。

一小群网络安全研究人员周日表示,他们于今年早些时候侵入了OpenAI,这一宣布为人工智能的安全和保障问题增添了一层新的担忧。 来自一家名为Hacktron的小型公司的研究人员发现,通过将两个未知漏洞串联起来——一个存在于第三方公司Discourse中,另一个存在于OpenAI验证其员工身份的方式中——他们可以访问员工的ChatGPT账号。 按照研究人员(有时被称为“白帽黑客”)的惯例,他们没有对公

09/19
cnbeta

曾被黑客用于攻破人工智能系统的“ASCII走私”隐身术 正被垃圾邮件制造者大肆利用

一项最初在人工智能越狱与提示词注入攻击中名噪一时的隐匿技术——“ASCII走私”(ASCII Smuggling),如今被大规模滥用于垃圾邮件与网络钓鱼活动。微软安全研究团队披露,网络攻击者正借由这一手段绕过主流电子邮件网关与反垃圾邮件系统,向数以百万计的邮箱投递诈骗信息。 “ASCII走私”的核心原理,是利用现代文本编码标准中人眼不可见或不渲染的特殊Unicode字符,将隐蔽信息嵌入看似正常的文

09/05
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…