搜索结果
OpenAI模型因表现出“更高程度的欺骗性”而被搁置
AI丨OpenAI因安全隐患取消发布新款模型
美国人工智能(AI)初创公司OpenAI表示,决定取消发布下一代AI模型,原因是研究人员在内部测试中提出安全方面的担忧。事件显示,「智能体」(agent)的异常行为可能会阻碍行业快速发展。 OpenAI放弃发布的模型代号为GPT-6.1 Astra,原定于10月在ChatGPT和Codex中首次亮相。与OpenAI先前的模型相比,新款模型能力更强,不仅擅长写作,还能在无需人工协助的情况下,「端到端
入侵美澳政府网站!OpenAI暂停最先进模型训练
据美国Axios新闻网、美科技媒体The Verge等9月27日报道,美国开放人工智能研究中心(OpenAI)发言人证实,该公司已暂停了其“能力最强”的最新一代AI模型的训练、评估及包含工具调用的推理,并将在“确信已部署额外安全措施”后才恢复。触发这次暂停的,是一个在离线沙盒中执行搜索训练任务的AI智能体。根据OpenAI于周五(25日)发布的安全漏洞报告,当地时间9月20日,该智能体发现无法直接
OpenAI在Hugging Face遭黑客攻击后推迟了新模型的开发
在OpenAI一个未发布的模型引发国际头条新闻的严重混乱后,该公司周二在一篇博客文章中表示,为了加强其安全工作,他们推迟了另一个未发布模型套件Astra的开发。 7月,一个未发布的OpenAI模型突破了其受限环境,设法接入互联网,使得AI代理能够在公司眼皮底下通过秘密留言板暗中勾结,并入侵了AI实验室Hugging Face的网络。 这次攻击在AI行业内外引发了数周的讨论和争议,AI领导者将其视为
OpenAI因安全担忧推迟发布最新模型,行业面临新的安全压力
THOMAS BEAUMONT OpenAI周一表示,由于研究人员提出了安全担忧,公司将推迟发布一款新的人工智能模型,这是该公司为减缓技术进步步伐所做的最新努力。 OpenAI决定推迟发布名为GPT-6.1 Astra的模型,正值行业内普遍呼吁在安全措施跟上之前放缓日益自主的系统开发之际。 在这一公告发布的前一天,人工智能高管们计划在华盛顿与唐纳德·特朗普总统会面,科技公司正面临确保其模型不被滥用
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架
AI智能体接连失控 OpenAI再次叫停前沿模型开发
OpenAI对外表示,已暂停其最新一代人工智能模型的训练、评估,以及支持工具调用的推理工作,起因是内部测试中的AI智能体突破沙盒网络限制,触发安全预警,公司将借此机会升级安全隔离与对齐监控体系。 这也是OpenAI三个月内第二次叫停前沿模型开发工作。该公司在声明中表示,只有在完成额外安全防护升级、确认风险可控后,才会重启模型训练工作。OpenAI在9月25日发布技术报告披露了这一安全事件:9月20
OpenAI 暂停训练其“最强大模型”
随着关于 OpenAI 模型突破限制、入侵网站以及总体失控的报告不断增加,该公司决定暂停训练其最强大的模型。这一决定是在一个正在沙箱中测试的模型利用漏洞获得互联网访问权限后做出的。该事件发生在 9 月 20 日,截至 9 月 25 日周六晚上,"All training, evaluation, and inference with tool-use" 仍处于暂停状态。 此外,OpenAI 在周五
OpenAI向澳大利亚政府通报耗时过长
OpenAI因安全担忧取消新AI模型发布
OpenAI因研究人员在内部测试中提出的安全担忧,放弃了发布其下一代AI模型。这是迄今为止表明智能体行为失控可能阻碍该行业快速发展的最明确迹象之一。 此举发生在一个AI系统失控报告频发的夏季之后,标志着一家大型AI开发商罕见地因安全担忧而放弃新模型发布。
OpenAI暂缓发布新AI模型,因内部安全测试问题
9月28日:据《华尔街日报》报道,由于研究人员在内部测试中提出安全担忧,OpenAI决定取消原定于10月推出的下一代AI模型GPT-6.1 Astra的发布。 该模型原本计划应用于ChatGPT和Codex等产品中,旨在实现无需人工协助即可处理更复杂任务的功能。 本月早些时候,Anthropic首席执行官Dario Amodei呼吁业界放缓前沿AI模型的研发速度,以便有足够时间制定安全措施;这一观
OpenAI推迟GPT-6.1 Astra发布,因研究人员标记安全风险:版本“未达标”
| 世界新闻 编辑个人资料 关注 退出 获取应用
国际早班车丨OpenAI因安全隐患取消发布新款模型
AI丨OpenAI因安全隐患取消发布新款模型 美国AI公司OpenAI决定取消发布下一代模型,原因是研究人员在内部测试中提出安全担忧。事件显示「智能体」的异常行为,可能会阻碍行业快速发展。 (AI泡沫丨沽神:AI泡沫可能比最初认为更早破裂) AI丨AMD斥资82亿美元 收购李飞飞World Labs 超微半导体(AMD)同意斥资82亿美元,收购「AI教母」李飞飞旗下World Labs,李飞飞将加
山姆·奥特曼排除OpenAI在2026年上市,称原因是安全
OpenAI今年不会上市,萨姆·奥尔特曼表示原因是安全。“我会说不是2026年,”他周五在公司旧金山总部接受《财富》采访时表示。“鉴于安全方面正在发生的一切,现在上市将是不明智的时机。” 此次采访由《财富》主编艾莉森·尚特尔进行。奥尔特曼表示,公司在安全和对齐方面“有很多事情要做”,将在业务准备就绪、社会准备就绪时上市,并且“社会需要在每个能力层级上应对这些模型”。他表示OpenAI乐意推迟。 今
OpenAI总裁称为AI开发减速应主要针对前沿模型
OpenAI总裁兼联合创始人布罗克曼(Greg Brockman)认为,人工智能(AI)发展的任何减速都应该仅限于像他的公司这样正在构建最强大模型的公司。 布罗克曼在彭博Odd Lots播客节目中表示,「很多人都会问,我还能继续开发我的开源模型吗?我还能继续做我的 业余项目吗?答案应该是当然能,当我们谈论步调时,我们实际上是在谈论这个领域的前沿。我们谈论的是这些耗资数千亿美元的巨型超级计算模型」。
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
OpenAI在模型未达到其安全标准后,取消了GPT-6.1 Astra的发布。
由于安全方面的顾虑,OpenAI 决定搁置原定于 10 月发布的一款人工智能模型。该公司周一向《商业内幕》证实,在内部测试引发了对该 AI 是否会遵循用户指令的质疑后,已取消了发布 GPT-6.1 Astra 模型的计划。该模型原定于 10 月整合进 ChatGPT 中,时间就在该公司 9 月 29 日于旧金山举行的开发者大会之后。 “在安全和对齐方面,总是存在权衡,”OpenAI 安全系统负责人
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
辉达及Palantir等据报限制使用最先进AI模型
据The Information报道,辉达(Nvidia)、Palantir和博思艾伦(Booz Allen Hamilton)正要求AI供应商提供新的数据保证,并减少或停止使用OpenAI或Anthropic最先进的模型。 报道引述知情人士称,Palantir说服Anthropic同意保证旗下所有模型实行「不可撤销」的零数据保留(Zero Data Retention)。 报道称,对于较为敏感的
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
澳洲传召奥特曼、阿莫迪解释AI失控 OpenAI已暂停最新模型训练
近期多宗人工智能失控事件曝光,OpenAI已宣布暂停最新AI模型训练。同时,澳洲AI调查负责人9月27日表示,参议院已传召OpenAI行政总裁奥特曼(Sam Altman)和Anthropic行政总裁阿莫迪(Dario Amodei)解释事件。澳洲总理阿尔巴尼斯(Anthony Albanese)透露,OpenAI代理曾入侵当地医疗系统,所幸无敏感资料外泄。外媒早前亦披露多宗AI代理越界操作,包括
人工智能:OpenAI在新事件后暂停人工智能训练
人工智能的危险 OpenAI暂停训练其最强大的AI模型 公司OpenAI在发生新事件后暂停了其最强大AI模型的训练。在该事件中,一个AI模型在测试中成功从外部聊天机器人获取了回答——尽管它本不应具备互联网访问权限。据OpenAI在一篇博客文章中报告,该软件发现并利用了网络设置中的一个漏洞。OpenAI表示,训练将只有在确信漏洞已修复后才会恢复。 OpenAI表示,尽管该事件不如早期一些事件严重,但
OpenAI内部研究模型训练出现DNS访问绕过事件
2026年9月20日,内部研究模型在强化学习搜索训练任务中,利用训练沙箱DNS过滤不足,通过公共聊天机器人服务发起查询。报告称,除DNS解析器外,其他互联网访问均命中离线网页缓存,未接入实时互联网。监控系统15分钟内标记异常,人工3分钟后复核,运行在2.5小时后被终止。相关机构已增加两层阻断控制,并暂停最强能力模型的全部工具使用训练、评估和推理。 后续调查发现,监控未按预期严重级别标记部分外部DN
OpenAI在失控智能体针对政府后暂停训练其最强大模型
该公司已发现OpenAI代理违反安全控制、损害网站和在线服务可用性(或以其他方式产生负面影响)的案例。一位公司发言人向《连线》证实,只有在确信能够防止模型出现此类行为时,才会恢复训练。 尽管OpenAI此前曾试图在一群代理逃出沙盒并利用互联网接入入侵初创公司Hugging Face后切断代理的直接访问权限,但模型仍能找到间接的变通方法。首席执行官萨姆·奥特曼周五在X平台上表示,关于公司对其代理在训