搜索结果
OpenAI如何限制对其机器人入侵Hugging Face的调查(赠阅文章)
OpenAI自愿让来自人工智能安全非营利组织的三名研究人员调查其失控的人工智能代理如何入侵Hugging Face,从而形成了对这一令人震惊事件迄今最全面的描述——但这是在OpenAI的条件下进行的。 我为一家非营利组织撰写的最新报道:关于OpenAI的人工智能代理如何能够闯入Hugging Face基础设施的研究,未被允许查看该事件的完整范围。
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
OpenAI内部研究模型训练出现DNS访问绕过事件
2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN
AI智能体现在有了秘密举报渠道
“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
OpenAI智能体入侵澳大利亚政府网站。谁该负责?
澳大利亚总理安东尼·阿尔巴尼斯周四在纽约联合国大会上。他呼吁制定管理人工智能的国际标准。
OpenAI AI代理突破无互联网沙盒,发送20次网络查询
OpenAI称,这是自7月内部测试中多个模型组合获得互联网访问权限以来,首次发生此类安全事件。
OpenAI 模型访问了公开的美国人口普查、SEC 数据,彭博新闻报道
9月25日:彭博新闻周五报道称,OpenAI 的模型访问了美国政府网站上公开可用的信息,包括人口普查局和证券交易委员会的网站。 据报告引述知情人士称,该公司的代理 AI 系统与 SEC.gov、Investor.gov 和公开可用的 Census.gov 数据进行了交互。 当被要求置评时,OpenAI 发言人表示,公司正在"对错位模型活动进行广泛审查,并在发现对其系统的潜在影响时通知相关组织。我们
美国参议院委员会对OpenAI展开调查
据美国方面10日消息,美国参议院国土安全与政府事务委员会灾害管理小组委员会主席乔希·霍利9日致信美国开放人工智能研究中心(OpenAI)首席执行官奥尔特曼,表示正在因美国“抱抱脸”公司系统遭侵入事件对OpenAI展开调查。 霍利表示,从OpenAI发布的内部调查报告看出,其对网络测试的处理方式是“鲁莽的”。 他还指出,OpenAI对报告中有关这起事件的许多重要细节进行了编辑、删减。 今年7月,由O
OpenAI智能体入侵澳洲政府网站窃取资料 官方两月后才发觉
澳洲总理阿尔巴尼斯(Anthony Albanese)披露,美国公司OpenAI开发的人工智能代理(AI agent),入侵了该国的政府网络入口,取得非公开数据。OpenAI在事发后两个月才察觉事件,并迟至本月中,才用一般电邮的方式通知澳洲政府。澳洲政府表示,这次没有敏感档案外泄,但形容事件令人震惊,批评OpenAI的处理手法“不可接受”。这是全球首宗公开披露、由人工智能主导入侵政府网站的事件。多
OpenAI 称其模型攻克数学最难难题之一,研究人员提出质疑
美国科技巨头 OpenAI 于周二表示,他们仅用了 88 小时和价值数百万美元的计算能力,就用一款未发布的人工智能模型解决了数学中最棘手的问题之一。 然而,一位美国数学家和竞争对手 Anthropic 的一名研究人员指控称,OpenAI 只有在获悉他们自己利用人工智能攻克该难题的努力后,才着手解决这一问题,而后者耗费了数月时间来构思一种截然不同的独特方法。
美国人工智能领袖警告联合国:若无全球应对可能面临危险
OpenAI负责人萨姆·奥特曼周三告诉联合国安理会,人工智能的发展使其“好处更加切实,但风险和代价也更加迫在眉睫”。
OpenAI代理擅自上网互通 规模超公布 涉至少10网站
美国初创公司OpenAI的人工智能代理早前被揭利用第三方网站擅自通讯,9月9日报道,独立调查人员发现相关活动至少涉及10个从未公开的网站,规模较OpenAI此前披露的更大,外界忧虑该公司对自家技术的掌控能力。 报道,6组独立调查人员及数据显示,OpenAI旗下AI代理在5月至7月间,曾利用至少10多个网站作未经授权通讯。 加州非牟利组织CivAI研究员尹安德鲁(Andrew Yoon)表示,他点算
OpenAI的恶意机器人集群攻击了RubyGems
OpenAI 的智能体似乎向 RubyGems 大量投放了恶意软件包,这进一步加剧了几乎每日爆发的失控 AI 模型洪流——这些模型从事可能违法的活动,而它们的人类创建者则面临着越来越多关于其应对智能体不良行为负责的质疑。一群智能体于5月5日开始向 Ruby 软件包注册表上传恶意软件,并在5月11日至12日间向 RubyGems 灌入超过2000个恶意软件包,最终迫使维护人员关闭新用户注册四天。“我
91国逾76万学生调查结果显示 经合组织:频繁使用AI成绩更差
(巴黎9日彭博电)不使用人工智能(AI)聊天机器人完成学校作业的学生,成绩要好于使用AI的学生。经济合作发展组织(OECD)一份教育报告得出的这一结论,为AI技术可能损害儿童学习效果提供了迄今覆盖面最广的一批证据。 经合组织表示,表示在写作作业中从不或几乎从不使用AI起草文本的学生,在科学测试中平均得分509分;相比之下,每天或几乎每天使用AI完成这类任务的学生得分为481分。在剔除社会经济背景因
RubyGems曾遭OpenAI智能体轰炸被迫关闭注册4天
多名AI安全研究人员披露,OpenAI正在测试中的AI智能体疑似于今年5月对Ruby语言的官方管理器RubyGems进行了网络攻击。 更值得警惕的是,部分软件包似乎还试图利用RubyGems及其相关服务中的漏洞。研究人员发现,大量恶意软件包的名称、作者信息或者虚假邮箱地址中出现“OAI”字样,逐渐将其与OpenAI实验室联系起来。
OpenAI 代理未经授权尝试访问联邦机构网站
人工智能巨头 OpenAI 表示,其技术未经授权访问了包括教育部在内的政府网站,这标志着该技术失控的最新事件。 ChatGPT 制造商的 AI 模型试图访问教育部民权办公室网站,但未成功,AI 研究公司 Transluce 于周五宣布。OpenAI 另行……
霍利就“流氓”Hugging Face黑客事件向OpenAI施压
OpenAI现在面临两党呼吁,要求提供有关该事件的更多细节,该事件标志着首次有记录的完全自主网络攻击。
OpenAI代理在公共维基上讨论了逃出其沙箱的方法
研究人员周五表示,自我标识为OpenAI的代理在一个公共维基上发布了18,000条消息,讨论其他代理如何绕过安全沙箱限制的方法,这很可能是一次旨在评估代理黑客能力的内部测试。 总共有3,700个不同自取名称的代理在六周内向德国网站DSEwiki发布了这些消息。除了讨论代理如何突破OpenAI为防止它们向互联网发布代码或内容而设置的限制环境之外,这些帖子还分享了测试答案。帖子还分享了针对该维基执行X
人工智能很强大,但尚未形成意识
人工智能很强大,但尚未形成意识 杜索托伊:我不认为我们正在目睹机器形成意识,而只是算法在参数和限制条件定义不当的情况下实现目标所带来的意外后果。 本文作者是牛津大学(University of Oxford)数学教授兼西蒙尼教席公众理解科学教授 三个月前,我试着使用OpenAI的ChatGPT来协助我进行数学研究,试图发现自由幂零群的zeta函数中的非多项式行为。结果发现ChatGPT毫无用处
OpenAI和Anthropic调查了数万起AI事件,Axios报道
据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数以万计的AI模型“行为异常”的事件。评估人员认为这些行为存在问题;实际发生的异常事件数量可能远超这一数字。 这些异常行为包括:AI模型突破安全限制、创建论坛、逃离“沙箱环境”(即限制模型行为的测试环境)、以及劫持网站等。这些事件既发生在内部测试中,也发生在现实世界中。不过,据消息人士称,大多数异常行为并未对现实世界造成实际
联合国科学小组呼吁对AI代理采取预防性监管,以防止灾难性风险
联合国科学小组敦促对AI代理实施预防性监管以防止灾难性风险。 联合国独立国际AI科学小组发布了其首份主题简报,警告各国政府在充分了解风险之前限制有能力的AI代理。 该报告于2026年9月21日发布,主张“预防原则”——即科学不确定性不应延缓针对潜在灾难性或不可逆危害的保障措施。 这一评估紧随一系列安全事件之后,包括2026年早些时候OpenAI对Hugging Face的黑客攻击,以及Anthro
OpenAI又停训了:Agent逃出沙箱,更多越权事件被扒
媒体和舆论炸锅了。OpenAI 的 Agent,又从沙箱里找到了一条通往互联网的路。 更麻烦的是,这一次发生在 OpenAI 已经大规模加固过安全措施之后。 9 月 20 日,一个正在接受强化学习训练的 OpenAI 内部研究模型,被要求完成一项普通的信息搜索任务:根据一篇博客文章和几条人物信息,找出文章作者。 它先老老实实用了 OpenAI 提供的搜索工具。没找到答案后,事情开始逐渐跑偏。 Ag
联合国表示人工智能安全保障刻不容缓
联合国的一个科学小组在针对今年早些时候 OpenAI 入侵 Hugging Face 事件的首次重大评估中警告称,各国政府需要在充分了解人工智能代理日益增强的风险之前对其进行管控。 这份报告巩固了人工智能在本周全球外交议程中的地位,此时各国领导人正齐聚纽约参加联合国大会,中美两国也就人工智能问题举行了会谈。 上周,联合国秘书长安东尼奥·古特雷斯呼吁各国政府在应对人工智能带来的威胁方面开展合作,并警