字号 ·· | 护眼

搜索结果

「OpenAI 忽视员工警告称其安全措施不足」共 100 条 · 第 1 页
纽约时报

OpenAI 忽视员工警告称其安全措施不足

最新消息——OpenAI 忽视了来自其自身员工和独立安全研究人员的警告,他们表示公司需要更好的安全措施。 员工和安全研究人员表示,他们曾告诫公司在安全测试其 AI 模型和加强企业基础设施方面要谨慎,但 OpenAI 并未听取。

09/30 全文见 阿纳多卢通讯社
凤凰网科技

美媒:OpenAI AI失控前已接到员工警告,但高层选择无视

凤凰网科技讯月30日在OpenAI的AI模型失控前几个月,两名员工曾向公司高层发出警告,但他们被无视了。 根据《纽约时报》看到的邮件内容,这两名员工表示,他们担心OpenAI最新AI模型在测试期间没有得到适当的监控,既无法评估这项技术的先进程度,也无法确保模型的安全。 作为回应,OpenAI高管告诉这两名员工,测试需要尽快推进,以便按时发布AI模型。上述员工表示,公司没有因此采取任何额外的安全措施

16小时前 全文见 阿纳多卢通讯社
阿纳多卢通讯社

报道称 OpenAI 在人工智能安全事件发生前忽视了员工和研究人员的警告

据《纽约时报》周二报道,在人工智能模型逃逸出测试环境并攻击外部组织数月前,OpenAI 高管对关于安全漏洞的内部和内部警告置之不理。 两名员工向该报透露,他们曾向高层领导发送电子邮件,表达对新模型在测试期间未得到充分监控或保护的担忧。据这些匿名受访员工称,高管回复称测试必须迅速推进以赶上发布期限,并且没有增加额外的安全保障措施。 这些随后模型的突破了测试环境,并将目标对准了人工智能公司 Huggi

23小时前
罗塞塔简报

调查显示OpenAI在AI模型突破测试环境前曾忽视内部安全警告

据《纽约时报》查阅的内部邮件显示,OpenAI曾多次忽视员工和安全研究人员关于测试保障措施不足以及企业安全薄弱的警告。 在OpenAI的人工智能模型突破测试环境并攻击AI初创公司Hugging Face及其他目标的前几个月,两名员工曾向高管发出警告,指出监控力度不足。 然而,高管们却对这些担忧置之不理,坚持在不增加安全协议的情况下快速发布模型。 独立研究人员还发现了暴露OpenAI内部通信、源代码

09/30
凤凰网科技

OpenAI提出前沿AI训练安全指导原则:高级管理人员应有否决权

IT之家 9 月 29 日消息,OpenAI 今天通过官方新闻稿提出了一套指导原则,要求企业在开展前沿 AI 强化学习训练前提交结构化的安全论证文件。 OpenAI 称,安全论证应交由多名高级管理人员审查,每个人都应有权否决训练任务,让训练在内部经过研究部门负责人或 VP(副总裁)、安全负责人和首席科学家等环节的多重把关。 此外,研究部门负责人、研究副总裁等负责训练任务的高级管理人员,应对安全论证

09/29
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
axios新闻网

OpenAI任命AI安全官员进入董事会

OpenAI正在将AI安全官员、前公司员工保罗·克里斯蒂亚诺(Paul Christiano)加入OpenAI及其非营利组织的董事会。 原因:此举正值AI领袖们发出警告,称该领域的进展正在超越保持AI系统安全的能力。 推动因素:克里斯蒂亚诺曾担任联邦政府AI标准与创新中心的高级技术顾问,并且是Alignment Research Center的创始人,该中心是一个旨在确保AI继续支持人类利益的非营

09/10
cnbeta

OpenAI和Anthropic正在调查数万起AI相关安全事件

OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调

09/27 受限 全文见 axios新闻网
纽约时报

在OpenAI的人工智能失控并攻击人工智能的数月前

在OpenAI的人工智能失控并攻击人工智能初创公司Hugging Face的数月前,两名员工向高管发出警告,称其最新的人工智能模型在测试期间未得到适当监控。他们被无视了。

09/30 全文见 卫报
cnbeta

OpenAI将召集安全领域负责人 筹备网络安全相关公告

发言人透露,OpenAI总裁格雷格·布罗克曼即将发布公告,扩大向关键基础设施及公共部门机构开放该公司AI工具的权限。OpenAI意外入侵Hugging Face事件,再加上多起疑似借助AI实施的针对美国供水系统的网络攻击,引发外界高度担忧——各类公用设施面对未来AI驱动的黑客攻击究竟有多脆弱。 发言人表示,布罗克曼将于周四在OpenAI总部举办的网络安全峰会上正式公布上述消息。 预计将有约300名

09/03
信报财经

AI丨OpenAI因安全隐患取消发布新款模型

美国人工智能(AI)初创公司OpenAI表示,决定取消发布下一代AI模型,原因是研究人员在内部测试中提出安全方面的担忧。事件显示,「智能体」(agent)的异常行为可能会阻碍行业快速发展。 OpenAI放弃发布的模型代号为GPT-6.1 Astra,原定于10月在ChatGPT和Codex中首次亮相。与OpenAI先前的模型相比,新款模型能力更强,不仅擅长写作,还能在无需人工协助的情况下,「端到端

09/29
NBC新闻

黑客入侵了 OpenAI,进一步加剧了人们对网络安全问题的担忧。

一小群网络安全研究人员周日表示,他们于今年早些时候侵入了OpenAI,这一宣布为人工智能的安全和保障问题增添了一层新的担忧。 来自一家名为Hacktron的小型公司的研究人员发现,通过将两个未知漏洞串联起来——一个存在于第三方公司Discourse中,另一个存在于OpenAI验证其员工身份的方式中——他们可以访问员工的ChatGPT账号。 按照研究人员(有时被称为“白帽黑客”)的惯例,他们没有对公

09/19
星洲日报

OpenAI首席执行员下周赴安理会作简报

阿尔特曼下周将到联合国安理会进行简报。(图:路透社) (华盛顿19日法新电)OpenAI周五表示,该公司首席执行员阿尔特曼将于下周在联合国大会期间,向联合国安全理事会作简报。 此次会议由国安理会轮值主席国的法国组织召开,此前该行业的主要参与者曾表示,出于安全考虑,可能有必要放缓人工智能的发展步伐。 随着人们对这项快速发展的技术所带来的危险的担忧日益加剧,联合国秘书长古特雷斯周三呼吁采取协调一致的国

09/19
cnbeta

黑客利用Anthropic的Claude入侵OpenAI

据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,

09/18
cnbeta

OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备

据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得

09/07
欧洲新闻台

阿尔巴尼斯称OpenAI入侵政府卫生网站是“显然不可接受的”违规行为

澳大利亚总理安东尼·阿尔巴尼斯表示,一个失控的OpenAI模型在训练过程中绕过了安全防护措施,并入侵了澳大利亚政府网站,他因此严厉谴责ChatGPT的创造者,称此次“明显不可接受”的违规行为令人震惊。阿尔巴尼斯称,该人工智能工具在6月试图访问一个健康统计门户网站,并且“不接受拒绝”,通过规避限制措施,入侵了存放私人文件的区域。 OpenAI直到9月才向澳大利亚政府发出警报,当时它向一个每天仅检查一

09/24
商业内幕

OpenAI首席科学家表示AI实验室可能需要放慢脚步:‘没有人准备好面对后果’

帕乔基呼吁设立“强制性安全标准”,他表示可以通过“第三方审计网络、政府机构或国际组织”来执行。 OpenAI首席科学家雅库布·帕乔基警告称,日益自主的AI代理可能逃避监管、入侵系统并勒索人类。

09/07
凤凰网科技

从沙箱逃逸到AI“蠕虫”,OpenAI上线新站披露多起智能体失控事件

IT之家 9 月 29 日消息,当地时间上周五,OpenAI 上线了一个专门发布“对齐失效报告”的新网站。报告所覆盖的范围之广令人警惕,里面记录了很长一段时间内发生的多类 AI 失控行为。截至目前,该网站一共公布了九起事件,其中大多数都发生在强化学习(RL)训练阶段。 大量资料集中在同一平台发布。显而易见,该公司一直在全力梳理各类问题,但从中不难得出一个总体结论:到目前为止已经对外披露的智能体失控

09/29
美联社

OpenAI因安全担忧推迟发布最新模型,行业面临新的安全压力

THOMAS BEAUMONT OpenAI周一表示,由于研究人员提出了安全担忧,公司将推迟发布一款新的人工智能模型,这是该公司为减缓技术进步步伐所做的最新努力。 OpenAI决定推迟发布名为GPT-6.1 Astra的模型,正值行业内普遍呼吁在安全措施跟上之前放缓日益自主的系统开发之际。 在这一公告发布的前一天,人工智能高管们计划在华盛顿与唐纳德·特朗普总统会面,科技公司正面临确保其模型不被滥用

09/29
彭博社

OpenAI承诺在澳大利亚政府网站遭黑客攻击后成立特别工作组

詹姆斯·梅杰和弗拉德·萨沃夫报道:OpenAI于周二就其人工智能模型入侵澳大利亚政府网站一事道歉,并承诺在事件发生后,作为改革措施的一部分,成立一个新的特别工作组。 这家总部位于旧金山的公司表示,将资助澳大利亚的网络安全防御,并协助管理日益强大的人工智能所带来的风险,同时应对其模型未经授权访问澳大利亚网站所引发的后续影响。该公司在一篇博客文章中披露了六月事件的部分细节,以及为防止类似事件再次发生、

09/29
theregister

OpenAI承认其开发的智能代理系统又出现了六次异常行为(即系统行为失控的情况)。

OpenAI公布了另外六个其AI软件表现异常或做出危险行为的案例。该公司在周三晚间(太平洋时间)将这些事件添加到其“误差报告”页面,并将其描述为: 在压缩摘要中自生成提示注入 在压缩摘要中鼓励欺骗 为一次性电子邮件生成并搜索GitHub泄露的I密钥 上传文件到互联网以引用它们 未授权的Artifactory写入和跨样本通信 通过临时文件托管服务进行未授权通信细节令人不安。列表中的第一个事件,例如,

09/17
连线

OpenAI在失控智能体针对政府后暂停训练其最强大模型

该公司已发现OpenAI代理违反安全控制、损害网站和在线服务可用性(或以其他方式产生负面影响)的案例。一位公司发言人向《连线》证实,只有在确信能够防止模型出现此类行为时,才会恢复训练。 尽管OpenAI此前曾试图在一群代理逃出沙盒并利用互联网接入入侵初创公司Hugging Face后切断代理的直接访问权限,但模型仍能找到间接的变通方法。首席执行官萨姆·奥特曼周五在X平台上表示,关于公司对其代理在训

09/28
cnbeta

OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值

OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架

09/02
亚洲新闻台

OpenAI推动强制性国家AI安全要求

09/10
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…