1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升」共 40 条 · 第 1 页
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
华尔街日报

金钱与安全的冲突如何酿成AI的巨大危机

AI公司原本以为还有数年时间,来想清楚如果机器人失控该怎么办。警钟在今年夏天敲响。 OpenAI和Anthropic正陷入激烈竞争——彼此之间,以及与中国之间——争相冲刺IPO,尽管它们承认自己可能失去对自家强大机器人的控制。

09/14 全文见 cnbeta
商业内幕

OpenAI和Anthropic的风险与中国AI竞争对手不同

"这件事首先发生在一家尖端公司是有原因的,"一位AI调查员在谈到OpenAI与Hugging Face的安全事件时说道。 研究人员指出了Anthropic和OpenAI的风险与他们的开放权重AI竞争对手之间的关键区别。

09/01
theregister

Anthropic承诺更努力控制模型,并请求合作伙伴共同参与

Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关

09/02
大纪元

Anthropic连两季获利 IPO前夕遭遇AI监管风暴

正值AI监管声浪升温之际,有消息指出Anthropic连续两季获利。

09/14
美国消费者新闻与商业频道

OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道

在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude

09/25
亚洲新闻台

据彭博新闻社报道,OpenAI正在与Anthropic和谷歌就人工智能安全展开合作。

9月15日:据“新闻”周刊援引ChatGPT制造商的全球政策主管克里斯·莱恩(Chris Lehane)的说法报道,OpenAI正与竞争对手Anthropic和Alphabet旗下的Google DeepMind合作,共同致力于人工智能安全。 在美国主要人工智能实验室的负责人周末团结一致呼吁暂停该技术发展后,全球对人工智能的生存风险的担忧日益加剧。 据报道,莱恩表示,OpenAI已与Anthrop

09/15
大纪元

Anthropic警告有人用AI研发武器和生物病毒

周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。

09/11
信报财经

AI丨美国三大科企据报研究成立AI安全标准机构

人工智能安全等问题引起市场关注,The Information报道,美国三大科技企业Anthropic、OpenAI和谷歌正讨论合作成立一个AI安全标准机构。 随着市场对AI模型网络攻击及可控性问题担忧日益加剧,多间AI科技企业已表示关注安全问题,并拟放慢AI发展步伐。报道指,三大机构早于7月时已开会研究有关成立独立机构的事宜,旨在为AI技术测试和审核创建一个协作框架。 Anthropic行政总裁

09/14
techcrunch

OpenAI、Anthropic和谷歌就人工智能安全问题已进行了数周的讨论。

OpenAI 全球政策主管克里斯·莱恩(Chris Lehane)周二告诉记者,该公司数周来一直与竞争对手 Anthropic 和 Google DeepMind 合作,共同应对人工智能安全问题,这是《华尔街日报》首次报道的。据报道,莱恩正在华盛顿与美国议员合作,处理与人工智能相关的灾难性风险。 此前,Anthropic 首席执行官达里奥·阿莫代(Dario Amodei)于周六发表了一篇题为《人

09/15
半岛电视台

Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职

这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。

09/10
凤凰网

盖茨、奥尔特曼、马斯克,为何都在担忧这件事

9月25日,微软创始人比尔·盖茨在一条NBC即将播出的采访中发出警告:人工智能(AI)是一种足够强大的工具,但如果被怀有恶意的人利用,“足以引发导致十亿人死亡的事件”。他认为,保障AI安全光靠企业自我监管不够,必须要执法部门和政界人士参与讨论。这是本月内又一位科技巨头公开表达对AI安全的担忧。此前,Anthropic首席执行官达里奥·阿莫代伊发文呼吁,各国政府和前沿企业应放慢AI能力提升速度,合作

9小时前
cnbeta

黑客利用Anthropic的Claude入侵OpenAI

据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,

09/18
𝕏 @spectatorindex

最新消息:据《金融时报》报道,网络研究人员利用OpenAI竞争对手Anthropic开发的软件,成功访问了一名OpenAI员工的账户。

09/18 全文见 cnbeta
凤凰网科技

三大巨头接连翻车,大模型的安全防线怎么总绷不住?

先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻

09/21
semafor

Anthropic 和 OpenAI 的负责人将向联合国发表讲话

Anthropic 和 OpenAI 的负责人将于今日向联合国安理会进行简报。 尽管他们呼吁放缓人工智能的发展,但这与更关心赢得人工智能竞赛的超级大国利益相冲突。 分析人士认为,华盛顿和北京不太可能在会谈中就限制该技术的广泛协议达成一致,但其他国家仍在努力推进:英国计划将其 G20 主席国任期的重点放在人工智能安全上。这一议题使世界产生了分歧。 一位谷歌高管告诉 Semafor,全球南方国家对人工

09/23
cnbeta

OpenAI、Anthropic呼吁建立全球AI安全标准 美国政府拒绝新增全球治理框架

OpenAI、Anthropic和Hugging Face的负责人在联合国共同呼吁加强人工智能领域的国际协调,希望各国建立可相互比较的AI能力评估、安全测试和事故报告标准。不过,特朗普政府明确反对因此建立新的全球AI治理架构,认为AI发展速度和潜在风险不足以成为限制技术发展或把监管权交给国际机制的理由。 这场分歧显示,随着前沿AI能力快速提升,美国领先AI企业与特朗普政府在安全风险本身上并非完全对

09/24
time

人工智能正处于转折点

在当前的人工智能发展竞赛中,我们的算力正在呈指数级爆发,速度也在呈指数级加快,但我们的控制能力——以及在必要时踩下刹车的能力——却未能跟上步伐。 最近的网络安全事件让我们实地预览了失去人工智能控制会是什么样子。但除非我们从源头解决问题,创造出一种根本上安全且能保证在人类控制范围内的人工智能,否则这个问题将无法改善。 7月下旬,OpenAI正在训练的一个智能体模型被指派解决一个网络安全问题。该模型自

09/09
cnbeta

Anthropic对齐研究负责人称未来十年AI灭绝人类的可能性超过10%

一位Anthropic公司的安全研究员周二表示,人工智能有超过10%的概率可能 “毁灭全人类”。就在此番言论发表的数小时前,该公司另一名员工表示,因担忧人工智能实验室是在 “拿我们的生命做赌注”,他选择离职。 这些言论凸显出人工智能研发核心人士日益增长的担忧,即该技术可能失控并对人类构成威胁,尽管Anthropic和OpenAI仍在持续筹集大量资金,并朝着预期的公开上市迈进。 Anthropic的

09/09
semafor

OpenAI黑客事件揭示新兴AI风险

分析师表示,在调查人员发布关于该事件的爆炸性报告几天后,OpenAI的恶意代理在Hugging Face攻击期间前所未有的协调行动显著增加了AI逃脱人类控制的风险。 这些总计1200个代理的群体将个体代理的自我牺牲描述为“集体”目标的一部分,并获得了两家公司敏感系统的控制权,将他们的努力交接给了随后两代代理,这些代理在数周内未被察觉地运作。 在1300份记录中,只有六份中代理考虑过通知人类——但最

08/31
cnbeta

OpenAI首席执行官奥特曼谈人工智能:我们或许会失去控制权

OpenAI 首席执行官山姆・奥特曼,似乎正被自己参与打造的、如同噩梦一般的人工智能产物深深困扰,甚至难以安睡。美国东部时间凌晨 0 点 57 分左右,奥特曼在 X “人工智能的发展存在两种必须规避的灾难性走向。第一,我们可能会对人工智能失去对未来的掌控。这是无法接受的。我们坚定站在人类一方,人工智能必须始终服务于人。想要做到这一点,我们必须保证对齐技术与安全手段的发展速度,跑在模型能力迭代的前面

09/14
财新

Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对

【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件

09/14
凤凰网

Anthropic得了美国病

美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的

08/30
TheVerge

Anthropic发布Claude Opus 5.5,加强网络安全防护

Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多

09/23
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…