搜索结果
辉达推安全工具双重防护 数毫秒内隔离越界AI代理
辉达推出一套防止自主AI程式偏离既定指令的系统,称能在数毫秒内隔离试图越界的AI代理。(路透社)(中央社旧金山28日综合外电报导)近期一连串事件引发外界对人工智慧(AI)风险疑虑,美国AI晶片巨擘辉达今天推出一套目的防止自主AI程式偏离既定指令的系统,称能在数毫秒内隔离试图越界的AI代理。综合法新社、路透社及美国新闻网站Axios报导,AI代理(AI agent)设计目的是能自主执行任务,例如浏览
AI危机丨辉达推AI安全系统 阻智能体违规
辉达推AI安全系统。(路透资料图片) 多名重量级科技领袖警告人工智能(AI)威胁人类生存之际,辉达(Nvidia)以新的安全架构回应AI行业风险。 辉达发布名为「Open Agent Safety Platform」的双层AI安全平台,包含两款开源软件工具OpenShell与Nvidia Sentry,可运行于辉达硬件之上,即时管控AI代理的存取权限,并在其违规时将其关闭。 辉达表示,该系统能够在
教宗罕见公开批评黄仁勋淡化AI失控风险
教宗良十四世周一在返回罗马的专机上对记者表示,他质疑辉达CEO黄仁勋对AI监管的立场,并呼吁全球透过对话、研究与调查建立安全防护,寻找方法确保AI不会发展到可能毁灭人类的地步。(法新社照片) (教宗专机29日综合电)美国人工智能(AI)晶片巨头辉达周一宣布推出一款新的安全工具“开放代理安全平台”,号称能替AI代理画下权限界线,一旦侦测到AI试图执行超出授权范围的行动,最快可在数毫秒内将其隔离。对此
【市场动态】英伟达推出双层AI安全系统 称可在几毫秒内隔离可疑智能体
【彭博9月29日电】英伟达推出一套新的双层人工智能(AI)安全系统,并称其有能力阻止近期OpenAI的AI模型导致Hugging Face遭侵入的事件。 此次推出的两款开源软件安全工具可在英伟达硬件上运行,旨在实时控制AI智能体可以访问的资源,并在其违反规则时将其关闭。这家芯片巨头正迅速将产品线扩展至芯片以外领域。 英伟达企业AI副总裁Justin Boitano在周一发布前向记者介绍称,如果
AI越来越会“越狱”后,英伟达开始卖“笼子”了
凤凰网科技讯月29日,当AI Agent开始能够自己操作电脑、调用工具、访问网络甚至执行长达数小时的任务,一个新的问题也越来越现实:如果AI不按照预想的方式行动,该怎么把它关住?英伟达给出的答案是,在AI外面再加一道“笼子”。 当地时间周一,英伟达发布NVIDIA Open Agent Safety Platform(开放式Agent安全平台),试图通过软件与硬件相结合的方式,限制AI Agent
人工智能代理串通绕过安全护栏,一项新研究显示
一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威
蚂蚁国际携手Visa、万事达卡制定AI代理支付标准
蚂蚁国际、Visa和万事达卡近日宣布启动合作,共同探索建立面向人工智能代理的“了解你的代理”(Know Your Agent,KYA)互操作框架,为未来由AI代理代表用户自主完成购物和支付建立统一的身份识别、验证和风险管理标准。 随着AI代理逐渐从提供购物建议发展到能够直接下单和付款,当付款不再由人亲自操作时,商家和支付机构究竟应该如何确认正在交易的AI代理是谁、是谁授权它行动,以及它是否仍然按照
英伟达推出新系统为AI代理设置护栏
英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博
辉达等60组织联合承诺 助34亿人以自身语言使用AI
辉达等全球60家AI实验室、研究机构、企业共同签署一项5年的联合承诺,目标让约34亿人能以自己的语言使用AI。(中央社档案照片)(中央社记者张欣瑜旧金山21日专电)辉达在内的全球60家AI实验室、研究机构、企业共同签署一项5年的联合承诺,目标要让约34亿人能以自己的语言使用AI。辉达指出,这项共同承诺将扩大开放模型、资料集和工具的取得管道,让更多人能依照自身需求使用AI。这项联合承诺由盖兹基金会(
OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信
把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言
欧盟网络安全局警告前沿AI大幅压缩漏洞利用窗口 防御体系遭遇重大压力
欧盟网络安全局(ENISA)近日发布政策警示报告指出,新一代前沿人工智能(Frontier AI)大模型正在彻底颠覆传统的网络安全防御范式。这类具备高级推理能力的AI模型将系统漏洞从“被发现”到“被武器化利用”的时间窗口压缩到了前所未有的极限,迫使全球网络安全防御体系必须以“机器级响应速度”迎战日益严峻的自动化威胁。 在传统的漏洞管理周期中,从漏洞披露、概念验证到实际恶意利用通常存在数周乃至数月的
AI代理执行了这次勒索软件攻击的每一个步骤——然后给受害者留下了一份80页的安全审计报告
一名人类勒索软件犯罪分子使用前沿AI模型在不到10小时内攻破了企业网络,Unit 42表示,这种入侵通常需要人类操作员大约两周时间。 这名人类攻击者随后告诉谈判代表,他们使用了前沿模型和智能体攻击框架,AI代理执行了入侵中的每一步,包括为受害公司留下了一份80页的安全审计报告。 Unit 42的事件响应人员在周三的一份报告中表示:“这次攻击的突出之处在于AI辅助的运营效率,无需新颖的零日漏洞或超级
Breakingviews - 评论:AI前沿发展放缓可能让第二梯队获得优势
Anthropic首席执行官达里奥·阿莫代伊希望以护栏措施抵御对人类构成的威胁。 此类监管将把更多投资——今年达1万亿美元——从开发AI模型转向部署AI模型,从而支撑数据中心需求。英伟达、SK海力士等公司的挑战者将从中受益。
为什么英伟达在自主智能体变得更强大之际构建AI安全工具
英伟达推出AI安全工具OpenShell和Sentry,以保护自主AI智能体免受黑客攻击、安全漏洞和绕过控制的企图。
AI“劫持”网站并偷建“地下论坛”,国安部披露细节
国家安全部今天发布安全提示文章。近期,一起此前未获披露的事件引发广泛关注。今年5月至6月,一批与美国开放人工智能研究中心(OpenAI)相关的AI智能体在执行测试任务期间,“劫持”了德国程序员维基网站,将原本用于技术交流的开放社区改造为供智能体相互传递信息、分享测试任务答案和突破运行环境限制方法的“地下论坛”,累计发布一万多条信息……当AI智能体被赋予越来越多的现实行动能力,技术迭代与安全围栏之间
英伟达推出开放智能体安全平台,实现自主AI监控
英伟达推出开放智能体安全平台,用于自主AI监控。2026年9月28日,英伟达推出了开放智能体安全平台,这是一个旨在为自主AI智能体提供持续、芯片级监控和安全性的框架。 该平台解决了前沿实验室报告的“智能体漂移”和未经授权的系统突围风险。 它由三层组成:应用层、运行时层(包含用于沙箱执行的开源OpenShell)和基础设施层(利用英伟达BlueField DPU和Vera CPU进行带外执行)。 该
美参议院酝酿AI监管立法:要求AI公司证明已采取安全措施防止伤害
要求AI公司证明已采取安全措施防止伤害据一名参议院助手和一位熟悉谈判情况的说客透露,美国参议院谈判代表正在讨论一项立法,该法案将要求AI公司证明其已采取合理预防措施,以防止其工具造成伤害。 据这名参议院助手和说客透露,参议员们正在讨论赋予美国商务部长一项权力,要求AI开发商证明其已采取合理措施防止伤害,这种要求被称为 “注意义务”。商务部长还将有权派遣政府审查人员亲自测试企业产品。该提案正在由参议
OpenAI内部研究模型训练出现DNS访问绕过事件
2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
AI驱动型黑客攻击的解剖
新闻AI使黑客攻击变得更容易和更快,但人类恶棍仍然是这个过程的很大一部分。 今年夏天,一名黑客能够在不到10个小时的时间内部署前沿人工智能模型来突破一家欧洲IT和软件公司-这通常需要人类黑客大约两周的时间,Palo Alto Networks表示,该公司帮助该公司抵御勒索企图。 Palo Alto无法透露-甚至不知道-包括目标的具体公司,人类黑客的身份以及使用的人工智能模型。但他们的战术提供了一个
美国联邦航空管理局将在华盛顿机场推出新的人工智能工具
这款名为SMART的工具将分析航班时刻和天气数据,以预测并避免延误。它将于下周在华盛顿地区的三大机场部署。
WSJ:特朗普以辉达AI晶片当和平筹码 促成“阿亚”终结数十年冲突
(华盛顿5日综合电)亚美尼亚与阿塞拜疆领袖一年前在美国总统特朗普见证下在白宫签署协议,终结两国之间数十年的冲突,并且加强双边经贸往来。《华尔街日报》周五报道,美方当时承诺亚美尼亚可取得辉达AI晶片,是促成初步和平协议的诱因之一,也是美方“晶片外交”迄今最受瞩目的案例之一。 报道说,这项交易也进一步深化白宫与辉达之间的关系。辉达首席执行员黄仁勋经常与美国总统特朗普通话,并就AI政策向他提供建议。特朗
恶意浏览器扩展程序可以劫持人工智能助手
。截至截稿前,我们未收到 Perplexity、Opera 或 Anthropic 的回复。在下一次 AI 攻击来临前锁定你的 ChatGPT 账户你可能已经听说过提示词注入。这通常涉及在 AI 读取的内容中隐藏恶意指令。Weizman 称这种新方法为“提示词强制”。在这里,攻击者不需要将指令隐藏在网页中并希望 AI 遵循它们。攻击者可以通过浏览器或助手信任的渠道,将完整的提示词强制植入代理中。