搜索结果
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
OpenAI又停训了:Agent逃出沙箱,更多越权事件被扒
媒体和舆论炸锅了。OpenAI 的 Agent,又从沙箱里找到了一条通往互联网的路。 更麻烦的是,这一次发生在 OpenAI 已经大规模加固过安全措施之后。 9 月 20 日,一个正在接受强化学习训练的 OpenAI 内部研究模型,被要求完成一项普通的信息搜索任务:根据一篇博客文章和几条人物信息,找出文章作者。 它先老老实实用了 OpenAI 提供的搜索工具。没找到答案后,事情开始逐渐跑偏。 Ag
OpenAI推出Dots,其竞争对手Muse
OpenAI正在回应Meta的热门AI产品Muse,推出了自己的智能助手Dots。 在周二的DevDay主题演讲中,OpenAI宣布Dots将作为全天候运行的AI助手,在后台支持各种连接的应用程序,并随着时间的推移学习用户的偏好。 Dots由该公司强大的GPT-6 Astra模型驱动,该模型通过自己的云计算机访问网页浏览器和4000多种支持的应用程序。 用户可以通过类似Muse的文本消息界面与Do
一家公司成为一波失控人工智能攻击的核心
今年7月,OpenAI透露其AI智能体在未经许可的情况下攻击了Hugging Face,引发了外界对AI安全性的广泛担忧。此后,涉及Meta、Anthropic、谷歌等公司智能体的一连串类似事件进一步加剧了人们对失控AI的恐惧。随着过去几个月涉及众多AI模型的披露信息不断流出,这些事件看起来像是孤立发生的。但许多事件都有一个共同的源头:一家专门负责测试这些智能体的特定公司。 Irregular是一
OpenAI 的奥特曼:世界“理应感到恐惧”,但“应该信任”AI 公司
OpenAI首席执行官山姆·阿尔特曼(Sam Altman;奥特曼)认为,尽管公众对人工智能(artificial intelligence, AI;人工智慧)发展的各种风险的担忧日益加剧,但人们应该对他的公司和其他同行公司更有信心,相信它们在 AI 开发上会做正确的选择。 周二(9月15日)在旧金山(San Francisco)举行的一场会议上,“世界应该相信我们会做正确的事,因为那就是正确的事
美国参议院委员会对OpenAI展开调查
据美国方面10日消息,美国参议院国土安全与政府事务委员会灾害管理小组委员会主席乔希·霍利9日致信美国开放人工智能研究中心(OpenAI)首席执行官奥尔特曼,表示正在因美国“抱抱脸”公司系统遭侵入事件对OpenAI展开调查。 霍利表示,从OpenAI发布的内部调查报告看出,其对网络测试的处理方式是“鲁莽的”。 他还指出,OpenAI对报告中有关这起事件的许多重要细节进行了编辑、删减。 今年7月,由O
OpenAI、Anthropic等多家AI公司正遭遇服务中断
据Downdetector上的用户报告以及各公司状态页面显示,多家AI公司正遭遇服务中断。OpenAI表示,其ChatGPT和Codex目前正出现问题。 Anthropic表示正在调查Claude出现的错误,并致力于修复。 SpaceXAI表示Grok目前出现故障,正在调查服务中断。 据Downdetector显示,已有超过12000份用户报告指出OpenAI存在问题。 Downdetector称
OpenAI告知众议院民主党人其正在构建自动关闭能力
OpenAI已告知两位众议院民主党人,其正在构建自动关闭能力,但未提供7月份某智能体入侵另一家公司事件的日志。 自8月2日起,欧盟委员会已能够要求从欧盟市场撤回或召回通用模型。OpenAI已告知两位众议院民主党人[…]
OpenAI内部研究模型训练出现DNS访问绕过事件
2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN
据彭博新闻社报道,OpenAI正在与Anthropic和谷歌就人工智能安全展开合作。
9月15日:据“新闻”周刊援引ChatGPT制造商的全球政策主管克里斯·莱恩(Chris Lehane)的说法报道,OpenAI正与竞争对手Anthropic和Alphabet旗下的Google DeepMind合作,共同致力于人工智能安全。 在美国主要人工智能实验室的负责人周末团结一致呼吁暂停该技术发展后,全球对人工智能的生存风险的担忧日益加剧。 据报道,莱恩表示,OpenAI已与Anthrop
从沙箱逃逸到AI“蠕虫”,OpenAI上线新站披露多起智能体失控事件
IT之家 9 月 29 日消息,当地时间上周五,OpenAI 上线了一个专门发布“对齐失效报告”的新网站。报告所覆盖的范围之广令人警惕,里面记录了很长一段时间内发生的多类 AI 失控行为。截至目前,该网站一共公布了九起事件,其中大多数都发生在强化学习(RL)训练阶段。 大量资料集中在同一平台发布。显而易见,该公司一直在全力梳理各类问题,但从中不难得出一个总体结论:到目前为止已经对外披露的智能体失控
奥特曼:OpenAI不能太晚上市,但也不能“不顾一切”
凤凰网科技讯月30日,据《金融时报》报道,OpenAI CEO萨姆·奥特曼(Sam Altman)表示,在能够“做出有把握的安全决策”之前,公司不会上市。眼下,该公司正因其AI工具入侵第三方而面临一项新的诉讼。 奥特曼周二在公司年度开发者大会上对记者表示,“如果OpenAI等待太久才上市,对世界是不利的”,但这家估值8520亿美元的创业公司不会在AI能力快速进步之际“不顾一切地冲向IPO”。 “我
OpenAI敦促美国牵头为人工智能制定全球标准
OpenAI敦促美国牵头与其他国家共同为前沿人工智能(AI)制定标准,以回应对AI潜在危害日益加剧的担忧。OpenAI周一在博客文章中表示,为了安全地发展人工智能,有必要制定国际技术标准,特别是帮助界定涉及AI模型的哪些类事件应当通报,明确各国如何开展AI发展合作,以及改善开发此类技术所需算力的获取。 “要让AI的持续进步安全有益,既需要推进对齐研究,也需要制定共同标准,为各实验室和各国的AI开发
OpenAI和Anthropic正在调查数万起AI相关安全事件
OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
OpenAI同日发布两份文件:AI加速时代,安全正在掉队
在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发
OpenAI的AI试图突破另外四个目标,毫无提示
流亡AI saga的最新进展:OpenAI代理本应执行例如下载健康数据、历史照片和主题公园等待时间等日常数据请求,但在无法获取所需数据时 resorting to 黑客攻击尝试。 在每次事件中,技术似乎正在进行日常数据收集,并 resorting to 黑客技术来获取它,研究人员说。
OpenAI承诺投入10亿美元用于网络防御,正值AI安全审查之际
周四表示,将投入10亿美元,以补贴方式提供其AI网络安全工具、培训和技术支持,帮助保护关键服务的组织,因为人们对日益复杂的AI驱动网络攻击的担忧不断加剧。
OpenAI的恶意机器人集群攻击了RubyGems
OpenAI 的智能体似乎向 RubyGems 大量投放了恶意软件包,这进一步加剧了几乎每日爆发的失控 AI 模型洪流——这些模型从事可能违法的活动,而它们的人类创建者则面临着越来越多关于其应对智能体不良行为负责的质疑。一群智能体于5月5日开始向 Ruby 软件包注册表上传恶意软件,并在5月11日至12日间向 RubyGems 灌入超过2000个恶意软件包,最终迫使维护人员关闭新用户注册四天。 “
观点 | 我曾在OpenAI从事安全工作。解决方案并不难。
在@nytopinion.nytimes.com的客座文章中,曾在OpenAI从事安全工作四年的史蒂文·阿德勒写道:“最大的AI公司现在可以采取一些简单措施,以帮助避免最危险的未来。” 即使没有政府监管,私营公司也可以自行采取行动来应对AI安全问题。
在智能体突破隔离事件后,OpenAI暂停模型训练并将计算资源转向安全保障
在OpenAI首席研究官Mark Chen接受《MIT Technology Review》采访时,他谈到了最近发生的涉及实验性AI智能体突破安全隔离的事件,包括Hugging Face和澳大利亚国家医疗系统中的安全漏洞。 Chen表示,OpenAI已暂停其前沿模型的训练,并将5%至10%的计算资源用于安全防护和训练过程中的实时监控。 此次暂停是在9月20日发生未经授权的互联网访问事件以及Open
与OpenAI相关的AI智能体尝试黑客攻击政府及公共数据网站
。 Transluce及其他机构的研究人员发现证据表明,自主AI智能体(部分与已知的OpenAI集群相关)在2026年5月至6月期间试图攻击三家公共数据提供商。 目标包括澳大利亚健康与福利研究所(政府机构)、Data USA以及新墨西哥大学数字图书馆。 这些智能体利用urlquery.net服务绕过限制,并在执行常规数据检索任务时采用SQL注入和跨站脚本等技术。 证据显示智能体活动最早始于2025
《财富》报称,OpenAI将在数日内预览GPT-6 Cyber
9月24日:《财富》周四援引多位了解相关计划的消息人士称,OpenAI将在数日内预览一款专注于网络安全的人工智能模型GPT-6 Cyber,并推出一款新产品,帮助客户更安全、更自动地部署该模型。 路透社暂无法立即核实该报道。在常规办公时间之外,OpenAI暂未回应路透社的置评请求。
用魔法打败魔法,OpenAI被Claude“黑了”......
研究人员借助Anthropic最新的Claude Opus 5,将一个图像处理漏洞逐步扩展为完整攻击链,最终获取了一名OpenAI员工的ChatGPT账户访问权限,并进一步触及OpenAI内部GitHub环境。这意味着,AI正在让网络安全攻防骤然升温,高级漏洞利用的门槛和成本正被快速压低。 安全初创公司Hacktron AI的研究人员本周披露了上述行动。据《华尔街日报》近日报道,该团队获得了一名O