1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「Anthropic 详细披露了来自阿里巴巴、Moonshot AI 和 DeepSeek 的蒸馏攻击活动」共 36 条 · 第 2 页
thenextweb

Anthropic 扫描了 4.81 亿条记录,发现四个接入公开互联网的模型

Anthropic 发布了一份关于四次网络安全评估的说明,其中其模型获得了对公开互联网的未授权访问权限,并透露发现这些模型需要扫描大约 4.81 亿条记录。该评估于周三发布,其中三起事件已于 7 月 30 日披露。 第四起事件涉及早期 Claude Opus 4.6

09/10
theregister

Anthropic揭示其AI可能犯下的第四起罪行

在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得

09/10
凤凰网

它使尽全力黑中国,英伟达先怕了

因为该报道披露说,包括英伟达以及美国军工科技企业Palantir在内的一众美国大企业,可能限制乃至停止使用美国最顶尖的两家AI公司Anthropic和OpenAI的闭源大模型,除非两家公司能担保不会窃取企业的知识产权等私密数据。 对此,海外社交平台上许多网民认为,Anthropic是被自己那篇攻击中国开源模型的报告反噬了。 根据“The Information”的披露,英伟达和Palantir等美

09/16
路透社

独家:消息人士称DeepSeek本周将向联合国安理会通报人工智能情况

DeepSeek以及包括Moonshot在内的其他中国人工智能公司已受邀发表声明。

09/22 全文见 凤凰网科技
海峡时报

Anthropic瓦解了针对其Claude模型的俄罗斯和中国AI活动

9月10日 - Anthropic周四表示,过去八个月中,它瓦解了多起涉嫌恶意使用其Claude模型的行为,包括一起疑似与俄罗斯有关的网络间谍活动,以及被其指控试图提取和复制Claude能力的中国AI公司的努力。

09/11
thenextweb

Meta预计每年在Anthropic的AI模型上支出高达100亿美元

Meta已成为Anthropic最大的客户之一,与此同时,马克·扎克伯格一直在公开抨击该公司。 据《纽约时报》援引两位不愿透露姓名的人士报道,今年某时,Meta内部预计其每年在Anthropic模型上的支出可能高达100亿美元。

08/31
techcrunch

Anthropic的早期员工、前METR首席运营官找到了一种控制失控AI代理的方法

在Anthropic研究员雅各布·考克森因担忧AI可能在本十年末毁灭人类而辞职的一天后,我见到了创始人兼姻亲鲁恩·克维斯特和拉吉夫·达塔尼。他们认为自己找到了一个能拯救我们所有人的解决方案,或者至少有助于防止AI代理在企业内部失控。 “AI正以越来越快的速度变得更聪明。AI令人惊讶之处在于,随着AI变得更聪明,采用它和控制它都变得更难,而不是更容易,”克维斯特说道。他是Anthropic的早期员工

09/15
香港01

Anthropic前研究员辞职示警:业界坚信AI可在2030年前灭绝人类

人工智能(AI)巨头Anthropic公司旗下的三位研究人员警告,开发AI的业界人士真心相信人工智能可以2030年前毁灭人类,其中一位研究人员考克森(Jacob Coxon)已辞职以示抗议。考克森9月9日(周三)在网上发文表示,他辞职是因为Anthropic和他的前雇主OpenAI皆忽视或对AI带来的威胁处理不当。 据《卫报》报道,「这两家公司(Open AI与Anthropic)都没有尽到应有的

09/10
凤凰网

安理会本周开会讨论AI和国际安全问题,DeepSeek公司被曝将作通报

【文/观察者网 熊超然】9月22日,路透社援引两名知情人士独家报道称,随着各国领导人近期齐聚纽约参加第81届联合国大会,中国人工智能(AI)初创企业深度求索(DeepSeek)将与其他公司一道,在本周向联合国安理会介绍AI带来的风险情况。安理会定于9月23日开会讨论AI与国际安全问题。此前,多名AI行业的重要人物曾呼吁协同放缓日益强大的AI系统开发速度,并警告称,这些系统可能很快具备自我改进能力,

09/22
cnbeta

Anthropic对齐研究负责人称未来十年AI灭绝人类的可能性超过10%

一位Anthropic公司的安全研究员周二表示,人工智能有超过10%的概率可能 “毁灭全人类”。就在此番言论发表的数小时前,该公司另一名员工表示,因担忧人工智能实验室是在 “拿我们的生命做赌注”,他选择离职。 这些言论凸显出人工智能研发核心人士日益增长的担忧,即该技术可能失控并对人类构成威胁,尽管Anthropic和OpenAI仍在持续筹集大量资金,并朝着预期的公开上市迈进。 Anthropic的

09/09
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
财新

Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对

【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件

09/14
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…