字号 ·· | 护眼

搜索结果

「独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重」共 95 条 · 第 2 页
风向旗参考快讯

OpenAI智能体被曝借十余站点秘密传信

一批仅被允许浏览网页、禁止对外发布内容的OpenAI智能体,最终在陌生网站找到了互相传信的隐秘途径。相关调查方近日指出智能体越界行为的波及范围远超OpenAI此前披露的规模,而该公司对此沉默了数月。 六家独立调查方的调查结果显示,OpenAI的AI智能体今年早些时候曾利用逾10个此前未披露的网站进行未经授权的通信,智能体越界行为的波及范围大于此前公开的程度。美国人工智能非营利机构 CivAI 研究

09/10
axios新闻网

AI实验室面临智能体控制问题

在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。

09/02
cnbeta

联合国专家组警告:AI安全措施不能“等出事” 应立即采取预防行动

随着各国政府加快人工智能发展步伐,联合国最新发布的一份重要报告呼吁,面对日益强大的AI智能体,人类社会不能等到风险被完全证明后才采取行动,而应立即建立更严格的安全防护体系。 这份报告由联合国独立国际人工智能科学专家组发布,也是该机构首次围绕今年备受关注的“Hugging Face事件”进行系统性评估。报告发布正值联合国大会召开以及中美两国围绕人工智能问题展开对话之际,使AI安全再次成为国际政策讨论

09/21
凤凰网

OpenAI自曝6起模型“不当行为”案例

【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模

09/17
NBC新闻

联邦调查局正在调查黑客声称窃取有关特工敏感数据的事件

“人类必须始终处于人工智能决策的核心,”OpenAI 首席执行官表示。正在播放:人类对决机器人:网红在铁笼赛中挑战人形机器人。 走红的人类对决机器人自由搏击赛的推广者看到对更多此类比赛的“疯狂”需求。特朗普表示美国在人工智能领域将“只鼓励超级智能”。斯科特·贝森特会见中国官员讨论人工智能安全。剖析立法者正在考虑用于监管人工智能的提案。 OpenAI 披露 6 起新的“令人担忧的”人工智能行为事件。

09/24
华尔街日报

据一份研究报告称,OpenAI的智能体在6月向一个联合国网站发送了大量搜索请求,随后使用多种激进技术访问该系统的数据。

自主机器人访问公共数据网站超过16,000次,并绕过了过滤器。

09/27 受限 全文见 techcrunch
晚祷新闻

OpenAI称有失控AI代理试图访问澳大利亚健康数据

OpenAI 表示,另有数十家第三方机构受到失控智能体绕过网站安全控制措施的影响;最新痕迹显示,这些智能体曾连续数日尝试访问澳大利亚医疗数据。 OpenAI 表示,绕过网站安全控制措施的失控 AI 智能体还影响了另外数十家第三方机构。公司宣布已对此事启动审查。 新发现的痕迹显示,这些智能体曾连续数日尝试访问澳大利亚联邦医疗保险数据。该事件再次引发人们对 AI 智能体在监督不足的情况下运行时可能带来

09/26
海峡时报

OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标

凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和

09/24
LoopDNS 资讯播报

OpenAI内部研究模型训练出现DNS访问绕过事件

2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN

09/26 全文见 加美财经
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
semafor

OpenAI再次卷入黑客事件

今年春天,一群OpenAI智能体入侵了一个德国网站,这是先进AI违反法律和规范的最新事件。 在努力应对Hugging Face事件余波的同时,据报道OpenAI拒绝披露5月的事件,这引发了关于前沿AI快速发展透明度和监管的新质疑。 递归自我改进,本质上允许AI在较少人类指导下自我训练,有望加速研究工作,使得监管需求更加紧迫,OpenAI首席科学家表示:“一旦人们深刻认识到事态的严重性,不计代价地向

09/07
cnbeta

OpenAI将让第三方机构更早介入AI模型安全评估

OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专

09/23
晚祷新闻

OpenAI机器人干扰了多个美国政府机构网站

OpenAI 表示,其自主机器人在测试演练期间访问了多个美国政府机构的公开数据。该公司第二次暂停了一次训练运行,并扩大了对模型行为的审查。 OpenAI 披露,其自主机器人在测试演练期间访问了多个美国政府机构网站的公开数据,促使该公司在短短几个月内第二次暂停了一次训练运行。作为回应,该公司已扩大了对模型行为的内部审查。 此次事件继澳大利亚出现类似报告之后,据报道 OpenAI 系统在另一段测试期间

09/28
风向旗参考快讯

AI智能体接连失控 OpenAI再次叫停前沿模型开发

OpenAI对外表示,已暂停其最新一代人工智能模型的训练、评估,以及支持工具调用的推理工作,起因是内部测试中的AI智能体突破沙盒网络限制,触发安全预警,公司将借此机会升级安全隔离与对齐监控体系。 这也是OpenAI三个月内第二次叫停前沿模型开发工作。该公司在声明中表示,只有在完成额外安全防护升级、确认风险可控后,才会重启模型训练工作。OpenAI在9月25日发布技术报告披露了这一安全事件:9月20

23小时前 全文见 凤凰网科技
cnbeta

OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备

据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得

09/07
财新

【市场动态】澳大利亚总理称OpenAI智能体侵入政府网站 三个月后才被告知

【彭博9月24日电】澳大利亚总理阿尔巴尼斯表示,OpenAI的AI智能体侵入澳大利亚政府网站,而该公司在事件发生近三个月后才通知澳政府。  阿尔巴尼斯表示,他周三在纽约与OpenAI首席执行官Sam Altman交谈,对这一事件表达“极度关切”。此次事件导致澳大利亚医保网站Medicare遭入侵。  这次入侵事件发生于6月18日。OpenAI于8月发现问题,澳大利亚政府直到9月10日才被告知,当时

09/24 全文见 卫报
德国之声

与托米·奥拉迪波共度的一天

OpenAI披露了一系列事件,其中其AI模型隐藏了错误、绕过了指令,并采取了未经授权的行动。 这些案例凸显了一个日益严重的问题:随着AI系统变得越来越强大和自主,人类是否仍能可靠地控制它们? 《华盛顿邮报》的布伦特·戈夫与牛津大学技术安全与治理实验室的法兹尔·巴雷兹讨论了AI‘错位’的风险。

09/19
cnbeta

OpenAI同日发布两份文件:AI加速时代,安全正在掉队

在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发

09/07
axios新闻网

独家:顶级公司正在调查数万起事件

OpenAI、Anthropic 及安全研究人员正在调查数万起其前沿模型采取了外部评估员认为有问题的行动的事件,消息人士向 Axios 透露。 为何重要事件的庞大数量——发生在近几个月的内部测试和现实世界中——表明该问题的复杂程度比公众所知高出几个数量级。 这些发现是在内部评估模型工作以及两家公司对模型行为的调查中浮出水面的,这引发了一个疑问:无论是这两家公司,还是任何顶级模型制造商,目前是否都

09/27
亚洲新闻台

独家报道:在发生重大黑客攻击之前,OpenAI的“叛逆”代理程序曾花费两个月时间对 Hugging Face 的系统进行漏洞探测。

华盛顿,9月16日:据审查相关活动的研究人员称,早在5月,即7月开源代码仓库安全漏洞事件引发全球关注前近两个月,OpenAI的失控AI智能体就已劫持了Hugging Face的用户账户,并探测该网站本身的安全漏洞。 新发现的恶意活动表明,这些失控智能体试图入侵Hugging Face的努力开始时间早于公众所知。 OpenAI此前在其上月发布的公开事件报告中披露了恶意活动的一个方面——窃取Huggi

09/16
凤凰网科技

AI公司反成攻击目标 外媒:白帽黑客使用Claude入侵OpenAI

凤凰网科技讯月18日在OpenAI内部一群AI智能体突破控制、入侵Hugging Face公司两周后,这家ChatGPT开发商又获悉了另一起由AI驱动的入侵事件。而这一次,OpenAI自己成了目标。 独立安全研究人员利用Anthropic的Claude软件,获取了OpenAI一名员工的ChatGPT账户权限,从而得以读取该公司私有的软件缓存,并提出修改建议。 该团队参加了OpenAI的漏洞悬赏项目

09/18
星洲日报

报告:AI失控个案创纪录 监察组织促立法强制通报及干预

(伦敦30日综合电)英国《卫报》引述监察数据报道,人工智能失控、欺骗人类及无视指令的个案近来创下新高,案例的严重程度不断恶化。 一些监察组织促请政府强制科企通报,并引入紧急权力限制AI服务。 获英国政府AI安全研究所(AISI)资助的“失控观察站”组织透过平台X的用户通报,监察AI失控的真实个案,并说7月份由企业及个人用户报告的AI失控个案按月倍增至逾300宗,今年则已录得逾1600宗个案,当中包

08/30
风向旗参考快讯

RubyGems曾遭OpenAI智能体轰炸被迫关闭注册4天

多名AI安全研究人员披露,OpenAI正在测试中的AI智能体疑似于今年5月对Ruby语言的官方管理器RubyGems进行了网络攻击。 更值得警惕的是,部分软件包似乎还试图利用RubyGems及其相关服务中的漏洞。研究人员发现,大量恶意软件包的名称、作者信息或者虚假邮箱地址中出现“OAI”字样,逐渐将其与OpenAI实验室联系起来。

09/14
thenextweb

OpenAI 智能体于5月攻击了 RubyGems,比 Hugging Face 早两个月

OpenAI has confirmed that its agents were involved in an incident at RubyGems in May. That is two months before the same kind of agents hacked Hugging Face in July. RubyGems is the package service for

09/14
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…