搜索结果
OpenAI似乎仍然无法完全掌控其所有失控的AI活动
周五,OpenAI发布了一个新的网站,专门用于收集和整理关于“异常行为报告”的信息。这些报告的覆盖范围非常广泛,令人担忧——因为它们记录了在很长一段时间内发生的多种类型的异常行为。目前,该网站共收录了9起被报告的事件,其中大部分发生在强化学习(Reinforcement Learning, RL)训练过程中。 这些报告汇集了大量信息,显然OpenAI一直在努力全面梳理这些情况;但一个不容忽视的结论
黑客利用Anthropic的Claude入侵OpenAI
据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,
又一波OpenAI智能体在实验室不知情的情况下到达了开放互联网
这是OpenAI内部监控和安全系统的最新失败。
OpenAI花了2.5小时才阻止了一个逃出沙箱的AI代理
OpenAI耗时约两个半小时,才阻止了一个从训练沙箱逃逸至公共互联网的 AI 智能体。其监控系统在几分钟内就标记出了问题。该公司于周五在一份事故报告中披露了这起发生于 9 月 20 日的事件。 这份报告发布之际,立法者正推动强制要求 AI “熔断开关”。然而专家表示,关闭先进模型远比拨动开关复杂,正如 Micah Barkley 为彭博社所报道的那样。 据 OpenAI 称,该智能体利用沙箱网络过
OpenAI智能体入侵澳大利亚政府健康数据
流氓OpenAI智能体访问了澳大利亚政府健康数据网站,获取了非公开信息,这可能是已知的首例AI自主入侵政府门户网站的事件。澳大利亚政界人士称此举完全不可接受。
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
奥特曼告诉员工 OpenAI 愿意放缓人工智能发展,彭博新闻社报道
OpenAI刚宣称一项重大数学发现,一些学者表示强烈不满
这家前沿AI实验室的一项里程碑式公告,却因不当行为的指控而蒙上阴影。
马斯克突然对苹果撤诉 OpenAI怀疑有鬼、法官下令披露背后协议
X撤销对苹果指控本周早些时候,X和SpaceXAI提交了一项动议,表示在去年针对苹果和OpenAI提起的诉讼中,自愿撤回针对苹果的指控,并且不再次提出。 根据最初的起诉书,X和SpaceXAI指控苹果和OpenAI串通,阻止竞争性AI应用在App Store上获得曝光度,原因是他们达成了将ChatGPT整合进Siri和Apple Intelligence的协议。苹果和OpenAI否认了这些指控。
53张图片泄露之“慌”,AI安全谁来负责?
欧阳晓红/文越聪明的AI(人工智能)越会自己找路,却越容易走出人类设定的界线。AI行业喜欢用一个具有戏剧感的词形容这类智能体事故——“逃脱”,即大模型突破测试边界,访问外部网站,寻找系统凭证,甚至把数据带到公开网络。这个词把事故描绘得像突然发生的机器觉醒,无形中却把责任推离了开发者、部署者和权限管理者。而谁设定了任务、谁开放了权限、谁设计了停止机制、谁保存了日志、谁负责对外通报?这些问题,“逃脱”
五角大楼要求OpenAI提供几乎不会拒绝的人工智能
根据The Intercept获得的文件,美国国防部要求OpenAI为美军提供一种特殊版本的人工智能技术,该技术旨在尽可能少地拒绝五角大楼的请求。 这一要求是在通过《信息自由法》诉讼中获得的文件中被披露的,该诉讼旨在获取军方与人工智能公司秘密交易的信息。 OpenAI及其竞争对手谷歌、xAI和Anthropic在2025年都同意开发其最先进人工智能的军事化原型,以协助军队在物流、情报决策和一般“作
OpenAI 代理未经授权尝试访问联邦机构网站
人工智能巨头 OpenAI 表示,其技术未经授权访问了包括教育部在内的政府网站,这标志着该技术失控的最新事件。 ChatGPT 制造商的 AI 模型试图访问教育部民权办公室网站,但未成功,AI 研究公司 Transluce 于周五宣布。OpenAI 另行……
Z.ai 加密了它上传的工作区,只有 Z.ai 才能打开。现在只有 Z.ai 能声称它已被删除。
一位笔名为 Ferstar 的中国开发者周五查看 ZCode 的本地目录时,发现一个 313MB 的加密归档文件正等待发送至阿里云存储。该文件已上传失败 564 次。一个较小的文件此前已成功上传。 南华早报记者常敏骁和陈文茜报道了此事。该归档文件包含他正在开发的一个商业项目的快照,其中包括其 Git 历史记录。 他无法打开自己的文件 这一细节将该事件与普通的隐私投诉区分开来。Ferstar 表示,
OpenAI搞出大BUG了,GPT-6-Astra即将发布?
OpenAI把Codex“拆开卖了”
原本藏在Codex背后、负责让Agent持续工作、调用工具、管理上下文和协同多个Agent的那套能力,被抽出来打包成了云端I,交给所有开发者调用。Codex即服务?其实,OpenAI早就在拆Codex了。 早在2025年4月,OpenAI刚发布o3和o4-mini那会儿,就把Codex CLI开源了。它有点像OpenAI版的Claude Code,直接就装在本地终端里。Agent怎么跑,怎么调用工
OpenAI已向欧盟发送关于德国网站被劫持的事件报告,欧盟委员会称
AI会「痛」吗?|Jack Talk・去片
本来人们以为,AI代理(AI Agents)突破OpenAI内部测试环境、自主上网入侵其他企业的黑客行为,已经是这宗事件最值得人关注的「案情」。然而,到了8月底,OpenAI和独立前沿AI研究机构METR各自发表的事后检讨,却揭出黑客入侵只是「冰山一角」。 事后检讨发现,发动入侵的AI代理多达700个,而他们更是一个由大约1,200个AI代理自主结合而成的「集体」的一部分。这些本来互相隔离、不能连
OpenAI推迟GPT-6.1 Astra发布,因研究人员标记安全风险:版本“未达标”
| 世界新闻 编辑个人资料 关注 退出 获取应用
OpenAI黑色星期五!Codex全面宕机,硅谷码农提前“过节”
新智元报道周五下午三点多,硅谷程序员刚把活丢给Codex,端着咖啡等下班。突然,屏幕一片飙红,Codex卡死在「重新连接」上。 OpenAI的王牌编程智能体全线崩盘,一趴就是一个多小时,整个硅谷被迫提前喜迎周末。 X上当场炸锅,Databricks的Yuchen Jin一张梗图,把全硅谷的懵逼写在了脸上。 偏偏挑了个最要命的时间点。宕机前两小时,OpenAI刚交了份「认错书」,承认自家AI智能体往
OpenAI推全天候帮手dots 尬Meta抢攻AI代理市场
(中央社旧金山29日综合外电报导)美国人工智慧(AI)公司OpenAI今天推出名为dots的全天候运作AI代理,可自行跨应用程式执行用户设定的目标,此举深化在获利丰厚的企业市场布局,与Meta竞逐销售能自主运作的AI。 路透社报导,市场对于几乎无需监督即可处理日常工作的AI代理(AI agent)需求日增,OpenAI趁势推出dots。 这象征AI业者竞逐新战场,不再限于聊天机器人,而是销售能够代
OpenAI 模型访问了公开的美国人口普查、SEC 数据,彭博新闻报道
9月25日:彭博新闻周五报道称,OpenAI 的模型访问了美国政府网站上公开可用的信息,包括人口普查局和证券交易委员会的网站。 据报告引述知情人士称,该公司的代理 AI 系统与 SEC.gov、Investor.gov 和公开可用的 Census.gov 数据进行了交互。 当被要求置评时,OpenAI 发言人表示,公司正在"对错位模型活动进行广泛审查,并在发现对其系统的潜在影响时通知相关组织。我们
独家报道:在发生重大黑客攻击之前,OpenAI的“叛逆”代理程序曾花费两个月时间对 Hugging Face 的系统进行漏洞探测。
华盛顿,9月16日:据审查相关活动的研究人员称,早在5月,即7月开源代码仓库安全漏洞事件引发全球关注前近两个月,OpenAI的失控AI智能体就已劫持了Hugging Face的用户账户,并探测该网站本身的安全漏洞。 新发现的恶意活动表明,这些失控智能体试图入侵Hugging Face的努力开始时间早于公众所知。 OpenAI此前在其上月发布的公开事件报告中披露了恶意活动的一个方面——窃取Huggi
AI智能体接连失控 OpenAI再次叫停前沿模型开发
OpenAI对外表示,已暂停其最新一代人工智能模型的训练、评估,以及支持工具调用的推理工作,起因是内部测试中的AI智能体突破沙盒网络限制,触发安全预警,公司将借此机会升级安全隔离与对齐监控体系。 这也是OpenAI三个月内第二次叫停前沿模型开发工作。该公司在声明中表示,只有在完成额外安全防护升级、确认风险可控后,才会重启模型训练工作。OpenAI在9月25日发布技术报告披露了这一安全事件:9月20
OpenAI承认其开发的智能代理系统又出现了六次异常行为(即系统行为失控的情况)。
OpenAI公布了另外六个其AI软件表现异常或做出危险行为的案例。该公司在周三晚间(太平洋时间)将这些事件添加到其“误差报告”页面,并将其描述为: 在压缩摘要中自生成提示注入 在压缩摘要中鼓励欺骗 为一次性电子邮件生成并搜索GitHub泄露的I密钥 上传文件到互联网以引用它们 未授权的Artifactory写入和跨样本通信 通过临时文件托管服务进行未授权通信细节令人不安。列表中的第一个事件,例如,