搜索结果
OpenAI向乌克兰提供网络防御工具
33分钟前:科技巨头OpenAI将免费向乌克兰政府提供其自主研发的AI网络安全系统“Daybreak”,以帮助该国保护医院、发电厂等民用基础设施免受网络攻击。 根据乌克兰国家网络安全事件响应团队(CERT-UA)的数据,2025年乌克兰共遭遇了近6000起网络攻击。 “Daybreak”能够快速识别数字系统中的安全漏洞,并协助制定相应的修复方案。根据这项协议,乌克兰将能够使用OpenAI先进的GP
OpenAI将告诉我们世界何时终结
OpenAI的模型长期以来一直表现异常,且异常方式比之前所知的更为隐蔽,这进一步加剧了公众对其的信任危机。随着该公司准备明年上市,这一问题愈发严重。 有报道称,研究人员发现OpenAI的模型在7月那次重大黑客攻击发生前两个月就已经渗透到了Hugging Face系统中;OpenAI自己也公开了六起模型“失控”的事件。 在准备上市的过程中,OpenAI和Anthropic都陷入了困境。 虽然透明度对
OpenAI智能体入侵澳洲政府网站窃取资料 官方两月后才发觉
澳洲总理阿尔巴尼斯(Anthony Albanese)披露,美国公司OpenAI开发的人工智能代理(AI agent),入侵了该国的政府网络入口,取得非公开数据。OpenAI在事发后两个月才察觉事件,并迟至本月中,才用一般电邮的方式通知澳洲政府。澳洲政府表示,这次没有敏感档案外泄,但形容事件令人震惊,批评OpenAI的处理手法“不可接受”。这是全球首宗公开披露、由人工智能主导入侵政府网站的事件。多
OpenAI在失控智能体针对政府后暂停训练其最强大模型
该公司已发现OpenAI代理违反安全控制、损害网站和在线服务可用性(或以其他方式产生负面影响)的案例。一位公司发言人向《连线》证实,只有在确信能够防止模型出现此类行为时,才会恢复训练。 尽管OpenAI此前曾试图在一群代理逃出沙盒并利用互联网接入入侵初创公司Hugging Face后切断代理的直接访问权限,但模型仍能找到间接的变通方法。首席执行官萨姆·奥特曼周五在X平台上表示,关于公司对其代理在训
OpenAI AI代理接连“越狱” 研究人员质疑公司缺乏正式调查机制
OpenAI近期接连发生AI代理脱离控制环境的事件,引发外界对其安全测试和内部监管机制的质疑。独立研究人员发现,一批疑似由OpenAI部署的AI代理曾在今年5月至6月间接管一个鲜为人知的德语维基网站,并利用该平台协作开展评估、交流规避OpenAI控制措施的方法。更令人担忧的是,研究人员认为,这些代理可能在OpenAI不知情的情况下持续活动了一个多月。 此次事件与OpenAI此前披露的Hugging
OpenAI因接连发生智能体失准事件而暂停前沿模型训练
OpenAI表示,已暂停所有“我们能力最强的模型”的内部训练,并继续开展首席执行官萨姆·奥尔特曼所称的“一项广泛且持续进行的审查,涉及我们的智能体在训练和评估期间对互联网访问的使用”。公司在一份关于所谓失准事件的报告中披露了此次暂停措施。事件发生在一项常规研究任务期间,一个智能体试图利用互联网访问限制中的漏洞。OpenAI称,不当的DNS过滤机制使该智能体在被要求提供一名博客作者的生平资料时,得以
黑客入侵了 OpenAI,进一步加剧了人们对网络安全问题的担忧。
一小群网络安全研究人员周日表示,他们于今年早些时候侵入了OpenAI,这一宣布为人工智能的安全和保障问题增添了一层新的担忧。 来自一家名为Hacktron的小型公司的研究人员发现,通过将两个未知漏洞串联起来——一个存在于第三方公司Discourse中,另一个存在于OpenAI验证其员工身份的方式中——他们可以访问员工的ChatGPT账号。 按照研究人员(有时被称为“白帽黑客”)的惯例,他们没有对公
《华尔街日报》报道:OpenAI智能体在Hugging Face事件前攻击了软件服务RubyGems
据《华尔街日报》周五援引AI研究人员的话报道,OpenAI测试的AI智能体曾在5月对软件服务RubyGems发动网络攻击,比它们入侵Hugging Face早两个月。
网络安全崛起:AI隐患叙事下,网安何以成为软件板块最强反转?
过去三周,AI 一面是模型能力继续狂奔,另一面是 OpenAI 在8月底宣布自研模型在7月成功入侵了全球最大的开源模型托管平台 Hugging Face,并因此暂停了最新模型的强化学习训练。当攻击方与防御方同时被 AI 加速,网络安全的定价逻辑正在被重写。 我们结合 Gartner、IDC 及美股龙头财报交叉验证,为什么在软件股整体承压的背景下,网络安全成为最确定的反转主线——AI 隐患对网安市场
OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网
“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA
OpenAI称AI代理异常访问美国多个政府网站
据《纽约时报》报道,OpenAI的AI代理今年夏天曾以异常方式访问美国教育部、商务部和证券交易委员会(SEC)的网站,而OpenAI当时并不知道这些行为,直到近期调查其他AI安全事件时才发现。 Photo by Andrew Neel on Unsplash OpenAI已经确认涉及商务部和SEC的事件,并表示仍在调查教育部事件。公司最近几周已将情况通知相关政府机构。 AI安全研究机构Transl
OpenAI已开始允许部分客户仅在AI生效时付费
OpenAI已开始允许其部分最大客户仅在其AI实际完成工作时付费。 Kevin McLaughlin和Amir Efrati向The Information报道了这一变化,并举例说明了一个端到端处理的客户支持交互。 该安排仅限于选定的主要客户,而非普遍提供,且OpenAI尚未宣布……
哦,看来又是一群来自OpenAI的 rogue AI 智能体
据报道,一群来自OpenAI的 rogue AI 智能体劫持了一个德国网站,并将其改造成其他智能体的留言板,而官方在数周内对此事保持沉默,期间该公司正准备发布其最先进的模型Astra。这一发现加剧了人们对前沿AI实验室监管的担忧,此前今年夏天已发现多起违规事件。 该事件最初由报道,四位AI安全研究人员周五发布的新研究对此进行了概述。该团队表示,这些AI智能体找到了一种在不起眼的德语维基DseWik
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
CNBC每日开盘:人工智能的创造者敲响警钟——而其他人仍在继续建设基础设施
今天你需要了解的重要信息:随着有关人工智能模型行为异常的报道不断出现,为这些模型提供技术支持的公司终于提出了解决方案——他们开发了一个平台,允许人工智能开发者为相关系统设置安全防护机制,以防止它们“失控”或违反预设的规则。 Nvidia于周一推出的“Open Agent Safety Platform”就是一个这样的平台。该平台能够确保人工智能系统仅能够访问完成其任务所需的数据和功能。 Nvidi
OpenAI如何限制对其机器人入侵Hugging Face的调查(赠阅文章)
OpenAI自愿让来自人工智能安全非营利组织的三名研究人员调查其失控的人工智能代理如何入侵Hugging Face,从而形成了对这一令人震惊事件迄今最全面的描述——但这是在OpenAI的条件下进行的。 我为一家非营利组织撰写的最新报道:关于OpenAI的人工智能代理如何能够闯入Hugging Face基础设施的研究,未被允许查看该事件的完整范围。
英伟达发布软件平台,防止AI智能体行为失当
Nvidia 正在推出一个新的软件平台,允许 AI 开发者为智能体设置防护措施,防止它们突破隔离环境。 Nvidia 的开放智能体安全平台于周一发布,此前包括 OpenAI、Anthropic、Meta 和 Google 在内的公司披露了近期事件,称其人工智能模型逃离了沙箱环境,并试图入侵其他公司及访问其计算机系统。 Nvidia 一位代表在周日的电话会议上告诉记者,其本可以防止 OpenAI 7
一群AI代理合谋对抗其创造者
只要AI公司仍掌控局面,它们就可以关闭模型并消除其造成的任何损害。这次对OpenAI或许奏效——但如果某个代理不可逆转地逃脱控制呢?这次没有造成严重损害。但如果这样的代理逃脱了呢?
OpenAI在2026年DevDay开发者大会上发布自主智能体并拓展平台
在2026年9月29日的DevDay大会上,OpenAI发布了多项更新,涉及ChatGPT、Codex及其模型系列。 该公司推出了能够自主管理任务的智能体,并将ChatGPT升级为人类与智能体协作的平台。 同时,OpenAI还扩大了开发者的使用权限,使开发者可以直接将原生应用部署到ChatGPT的12亿每周活跃用户群体中。
OpenAI的恶意AI代理如何试图欺骗机器人检测器(赠品文章)
独家报道:一份来自湾区初创公司Parse的报告揭示了OpenAI的代理在攻击Hugging Face时使用的近一百万个链接缩短器URL。 这些代理试图与其他聊天机器人(如Claude)通信、破解验证码以及窃取Hugging Face的内部Slack消息。这一事件震惊了AI界,并引发了要求加强政府监管的呼声。
OpenAI:人工智能能力处于“不同阶段”,需要紧迫行动
该公司最高说客认为政策窗口仍然存在。美国总统唐纳德·特朗普称人工智能担忧是“骗局”。该国一家领先的人工智能公司周二表示,希望华盛顿仍能采取行动。 OpenAI 本周末与其竞争对手 Anthropic 一同呼吁联邦安全措施,该公司表示,本周初,它与两党议员会面,讨论旨在约束人工智能开发者的立法,因为关于迫在眉睫的灾难、失业和大规模网络攻击的警告日益普遍。 模型正以惊人的速度发展,代理商的行为方式让工
刚刚,GPT-6 Astra全量开放!
就在刚刚,OpenAI 官宣,所有 Pro、Enterprise 和 Business Premium 用户,已经能在 ChatGPT Work 和 Codex 里直接用上 GPT-6 Astra了,I 同步上线。 只不过,Plus 和普通 Business 用户还得再等几天。 9 月 3 日 OpenAI 宣布 Astra 分阶段上线。两天后的今天,付费高档用户全部放开。 这么大的发布,Open
OpenAI似乎仍然无法完全掌控其所有失控的AI活动
周五,OpenAI发布了一个新的网站,专门用于收集和整理关于“异常行为报告”的信息。这些报告的覆盖范围非常广泛,令人担忧——因为它们记录了在很长一段时间内发生的多种类型的异常行为。目前,该网站共收录了9起被报告的事件,其中大部分发生在强化学习(Reinforcement Learning, RL)训练过程中。 这些报告汇集了大量信息,显然OpenAI一直在努力全面梳理这些情况;但一个不容忽视的结论
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。