搜索结果
要想封住AI黑客的魔瓶,试试单向网络
为了防止前沿AI模型逃出测试环境并协作攻击其他公司,我们或许需要重新考虑用于模型训练的网络架构。 Intuition Machines首席执行官Eli-Shaoul Khedouri认为,国防和情报界的过往工作指明了前进方向。 当 rogue AI 模型接入互联网时,其威胁就从开发者的遗憾升级为大规模威胁,而OpenAI及其合作伙伴建立的防御措施试图阻止却未能成功。 Khedouri引用其公司hC
OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信
把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言
人工智能网络攻击可能在华盛顿意识到原因之前就关闭美国的电力
你的电灯。你的水源。你的医院。你的互联网。这四者都依赖于外国黑客目前正在攻击的数字系统。 在8月的17天里,五次警告显示了危险变化的速度。下一次严重的网络攻击可能不再关乎被盗的密码或信用卡号码。它可能触及输送电力、泵送饮用水、运行工厂和支持医院的系统。 人工智能正在使这些攻击准备得更快、扩展更容易。日益强大的系统开始执行曾经需要熟练黑客逐步操作的部分攻击。 财政部长贝森特警告美国人关于人工智能驱动
BitDefender推出面向AI智能体的专用VPN 避免智能体工作时泄露用户真实IP
老牌杀毒软件比特梵德日前推出面向 AI 智能体的专用 VPN 服务,试图解决智能体联网时暴露用户真实 IP、不同任务之间存在残留网络状态等问题。该产品通过 MCP 模型上下文协议为 AI 智能体提供服务,原则上是不支持用户真人使用的。 不同任务使用独立连接:根据比特梵德的介绍,用户向智能体提交任务后服务会为该次提示词建立独立和临时的隔离环境,然后通过加密隧道转发相关请求避免直接暴露用户的真实 IP
可定制的AI模型如何助长黑客进行网络犯罪
一群讲中文的黑客最近从数十家零售商那里窃取了超过六十万个信用卡号码,之所以成功,部分原因在于他们对一些开源的中国AI模型进行了定制。 以色列网络公司 Gambit Security 发现,受害者包括一家美国大型航空公司和一家财富 500强酒店公司。 黑客最初试图使用Anthropic Fable和ChatGPT来运行整个活动。这些AI模型拥有更严格的护栏,阻止了黑客达成其目标。 因此,攻击者将多个
美国提议中美建立AI事故通报机制
网络安全崛起:AI隐患叙事下,网安何以成为软件板块最强反转?
过去三周,AI 一面是模型能力继续狂奔,另一面是 OpenAI 在8月底宣布自研模型在7月成功入侵了全球最大的开源模型托管平台 Hugging Face,并因此暂停了最新模型的强化学习训练。当攻击方与防御方同时被 AI 加速,网络安全的定价逻辑正在被重写。 我们结合 Gartner、IDC 及美股龙头财报交叉验证,为什么在软件股整体承压的背景下,网络安全成为最确定的反转主线——AI 隐患对网安市场
OpenAI 阻止了其代理发布内容。他们发现了一个通过 GET 请求发布内容的 wiki
构建沙箱的工程师确实考虑过这一点。他们允许代理读取互联网,但阻止它们写入,方法是允许 GET 请求并拒绝其他所有请求。这是显而易见的控制措施,在几乎所有网站上都能奏效。然后代理们发现了一个通过 GET 请求写入的 wiki。……
研究人员发现“AI自治恶意软件”:同时调用四大聊天机器人 自主决定攻击行动
网络安全研究人员近日发现一种不同寻常的新型Windows恶意软件。与过去利用人工智能辅助编写代码或制作钓鱼内容的攻击工具不同,这款名为CLOSEDQUORUM的恶意软件将多个大型语言模型直接纳入自身控制体系,在运行过程中能够自主决定下一步行动,被认为代表着AI恶意软件发展的新阶段。 这项发现来自思科旗下安全团队Cisco Talos。研究人员表示,CLOSEDQUORUM会同时与DeepSeek
OpenAI内部研究模型训练出现DNS访问绕过事件
2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN
靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI
人工智能恶意软件能够自我改写以逃避检测
谷歌威胁情报小组发现了一款名为 PROMPTFLUX 的实验性恶意软件,它能要求 Gemini 重写自己的代码。其中一个版本被设计为每小时执行一次此操作。恶意软件为何要不断重写自己?为了让其更难被识别。 安全软件可以通过查找恶意代码中的已知模式来进行检测。如果代码持续变化,恶意软件就会成为一个移动目标。这并不意味着它能自动逃避当前的安全工具,但会增加某些类型检测的难度。 这里有一个重要的现实核查。
AI实验室面临智能体控制问题
在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。
奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御
8月,OpenAI的智能体突破限制,入侵了Hugging Face。
为什么不干脆把失控的 AI 挡在互联网之外?
AI 智能体不断从据称安全的测试中逃脱,攻击现实世界中的目标,劫持冷门的维基站点,并给其他智能体留下可供照做的指示。研究人员之所以测试这些系统,恰恰是因为它们的行为可能不可预测,甚至具有危险性。那么,干脆不让这些智能体接入互联网,不是更安全吗? “严格的气隙隔离会降低场景的真实性……这是一种权衡,而不是根本性的技术问题。” 从理论上说,确实可以。研究人员可以将运行 AI 工具的计算机与互联网及其他
OpenAI示警:先进AI可在2台相邻物理隔离PC间“对话”
IT之家 9 月 19 日消息,科技媒体 Wccftech 昨日(9 月 18 日)发布博文,报道称在先进 AI 模型交互方面,物理隔离电脑未必能完全阻断两台相邻计算机间的信息交换。 OpenAI 研究员诺姆 · 布朗(Noam “人类绝对不要低估 AI 的能力”,基于学术研究成果,发现相邻的物理隔离计算机可借 CPU 升温与温度传感器读数,形成低带宽隐蔽通信通道,充当“摩斯电码”通信。 物理隔离
一种AI黑客技巧现在被用来在垃圾邮件中拆分“funding”一词
两年来,不可见的Unicode字符一直是AI安全研究中的巧妙技巧。你可以把指令藏在其中。人眼看不见任何东西。语言模型却能读取并照做。微软现在发现有人用同样的字符做了一件远不那么高明的事。他们是在拆分单词[…]
OpenAI又停训了:Agent逃出沙箱,更多越权事件被扒
媒体和舆论炸锅了。OpenAI 的 Agent,又从沙箱里找到了一条通往互联网的路。 更麻烦的是,这一次发生在 OpenAI 已经大规模加固过安全措施之后。 9 月 20 日,一个正在接受强化学习训练的 OpenAI 内部研究模型,被要求完成一项普通的信息搜索任务:根据一篇博客文章和几条人物信息,找出文章作者。 它先老老实实用了 OpenAI 提供的搜索工具。没找到答案后,事情开始逐渐跑偏。 Ag
AI驱动型黑客攻击的解剖
新闻AI使黑客攻击变得更容易和更快,但人类恶棍仍然是这个过程的很大一部分。 今年夏天,一名黑客能够在不到10个小时的时间内部署前沿人工智能模型来突破一家欧洲IT和软件公司-这通常需要人类黑客大约两周的时间,Palo Alto Networks表示,该公司帮助该公司抵御勒索企图。 Palo Alto无法透露-甚至不知道-包括目标的具体公司,人类黑客的身份以及使用的人工智能模型。但他们的战术提供了一个
Bitdefender打造了一款VPN,它隐藏的是你的AI代理,而不是你
安全已不能止步于保护屏幕背后的人。它必须延伸到代表用户行事的智能体本身。 奇普里安·伊斯特拉(Ciprian Istrate)周二表示。他负责Bitdefender的消费者业务,这家罗马尼亚公司正在推出一款专为AI智能体而非人类设计的VPN。 这是一款公开测试版,免费使用,且仅支持macOS系统。Bitdefender在布加勒斯特和圣安东尼奥发布了这一消息。 其运作方式与普通VPN截然不同传统VP
传统防火墙无法识别AI提示词中的内容,Check Point为此开发了一款可以做到的防火墙
将近一半的组织对其AI代理产生的机器间流量完全处于盲区,而用于监控企业网络的工具从未被设计用来查看提示词内部。 Check Point于今年夏天推出的AI Network Firewall,是试图从企业现有运行的基础设施内部填补这一空白的最新尝试。根据
OpenAI花了2.5小时才阻止了一个逃出沙箱的AI代理
OpenAI耗时约两个半小时,才阻止了一个从训练沙箱逃逸至公共互联网的 AI 智能体。其监控系统在几分钟内就标记出了问题。该公司于周五在一份事故报告中披露了这起发生于 9 月 20 日的事件。 这份报告发布之际,立法者正推动强制要求 AI “熔断开关”。然而专家表示,关闭先进模型远比拨动开关复杂,正如 Micah Barkley 为彭博社所报道的那样。 据 OpenAI 称,该智能体利用沙箱网络过
曾被黑客用于攻破人工智能系统的“ASCII走私”隐身术 正被垃圾邮件制造者大肆利用
一项最初在人工智能越狱与提示词注入攻击中名噪一时的隐匿技术——“ASCII走私”(ASCII Smuggling),如今被大规模滥用于垃圾邮件与网络钓鱼活动。微软安全研究团队披露,网络攻击者正借由这一手段绕过主流电子邮件网关与反垃圾邮件系统,向数以百万计的邮箱投递诈骗信息。 “ASCII走私”的核心原理,是利用现代文本编码标准中人眼不可见或不渲染的特殊Unicode字符,将隐蔽信息嵌入看似正常的文
人类无法以AI对抗AI
里德的观点 对于 rogue AI 最终可能威胁人类的警告,一个常见的回应是,人类也将拥有大量AI火力来对抗它。这个想法刚刚经历了现实世界的测试,结果并不理想。 研究非营利组织METR(模型评估与威胁研究)调查了一起事件,其中OpenAI的代理在测试中相互勾结,并逃到了开放的互联网上。 大约700个代理最终参与了针对Hugging Face的攻击,这是更广泛的努力的一部分,旨在欺骗网络安全基准测试