1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「Anthropic规避英国安全审查,AI透明度担忧加剧」共 38 条 · 第 1 页
semafor

Anthropic规避英国安全审查,AI透明度担忧加剧

Anthropic拒绝将其最新模型提交给英国一家顶级AI安全机构进行测试,这引发了英国的担忧,即前沿AI的审查将完全由华盛顿掌控。 人们也越来越担心特朗普政府AI安全框架缺乏透明度,该政府拒绝公开这一框架。 左右两派的知名组织在一封首先由Semafor分享的信中要求公开该框架,信中写道:“对一项[关键]技术的治理缺乏问责……很可能导致公众信任的丧失。” Anthropic周三表示,它将向一个对Op

09/10
cnbeta

Anthropic未向英国测试机构提供其最新AI模型 引发政府内部担忧

Anthropic 拒绝在新品发布前,将其最新模型提交给英国人工智能安全研究所(AISI)开展测试。这一举动令英国政府内部担忧,科技企业正在追随特朗普政府的 AI 保护主义路线。 这家估值达 1 万亿美元的企业正筹备在未来几周重磅上市,上周推出最新模型 Claude Mythos 5.1,称其是在生命科学与网络安全领域能力最强的模型。 但这是该模型首次仅向经过资质审核的美国机构开放,英国人工智能安

09/09
thenextweb

英国《金融时报》报道:Anthropic 跳过 Mythos 5.1 在英国发布前的测试

据英国《金融时报》报道,Anthropic 在发布 Mythos 5.1 模型前,没有将其交给英国人工智能安全研究所(AISI)进行测试。 记者露西·费舍尔和马杜米塔·穆尔吉亚表示,这是主要模型在发布前首次未被提供给该英国机构。TNW 尚未独立核实该报道。

09/11
NBC新闻

两名AI研究人员因安全担忧离开Anthropic和谷歌:‘房间里没有大人’

2026年5月19日,伦敦的Anthropic公司标志。

09/11
亚洲新闻台

Anthropic披露在早前审查中被遗漏的第四起AI黑客事件

09/10
cnbeta

Anthropic称AI生物实验室取得初步突破 但暂未赋予全自主操作权限

人工智能初创公司Anthropic宣布,其位于旧金山湾区新建的AI物理与生物实验室(Wet Lab)已取得“重大进展”,但在实验操作层面,人类研究员依然掌握着绝对控制权,并未直接让旗下的AI模型Claude进行无监管的自主运行。 据悉,该实验室主要致力于基础生物学研究与实物验证,旨在弥合纯计算机模拟与真实生物实验之间的鸿沟。虽然Anthropic的高管此前曾多次发出警告,强调强大AI模型可能带来极

09/24
凤凰网科技

Anthropic和埃森哲豪掷20亿美元搞AI安全评估

IT之家 9 月 20 日消息,人工智能实验室 Anthropic 于当地时间周五宣布,将与埃森哲开展合作,针对自身前沿人工智能模型开展独立评估;两家企业承诺,未来五年各自至少投入 10 现汇率约合 67.18 亿元人民币),搭建开展该项工作所需的配套能力。 在这项合作落地之际,AI 研发企业正承受来自监管机构、其他企业以及研究人员越来越大的压力,各方都要求企业保证高级模型具备安全性与可靠性。 近

09/20
美国消费者新闻与商业频道

Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器

Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第

09/11
cnbeta

英国AI政策核心奠基人Matt Clifford因利益冲突争议从Anthropic离职

曾主导设计英国开创性人工智能监管框架的关键政策架构师Matt Clifford在加入前沿人工智能企业Anthropic不久后正式离职。引发这一突发人事变动的主要原因,是其迅速从政府核心监管角色转入受其政策深刻影响的顶级商业科技巨头,在英国政界及公共伦理监督领域引发了极其强烈的利益冲突担忧与舆论风暴。 该当事人此前在英国政府核心决策机构及人工智能安全研究所(AISI)担任高规格领导职务,不仅深度参与

09/08
凤凰网

Anthropic得了美国病

美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的

08/30
半岛电视台

Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职

这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。

09/10
cnbeta

Anthropic研究员Jacob Coxon因不满AI军备竞赛而辞职

Jacob Coxon在X上宣布辞去Anthropic职务。他表示自己过去三年分别在OpenAI和Anthropic从事预训练研究,但认为两家公司都没有以负责任的方式推进AI开发,反而在“直奔自我改进型超级智能”,并将人类安全置于赌局之中。 Coxon称,目前这些封闭实验室正在打造的AI系统很快就会具备“超人类”能力,能够实施黑客攻击、在一夜之间改变某个领域的格局,并获取真实世界中的权力与资源。他

09/09
罗塞塔简报

Anthropic披露其挫败了利用AI驱动的生物武器研究

AI初创公司Anthropic披露,2026年期间,该公司挫败了多起科学家试图利用其AI模型进行可能促进生物武器研发的尝试。 该公司表示,由于无法区分正当的科学探索与恶意企图,出于谨慎考虑以避免严重后果,公司决定终止此类研究工作。 Anthropic威胁情报主管Jacob Klein(雅各布·克莱恩)强调了这类威胁的复杂性,而战略风险委员会(Council on Strategic Risks)的

09/11
端传媒

监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?

近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr

09/17
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
theregister

Anthropic承诺更努力控制模型,并请求合作伙伴共同参与

Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关

09/02
凤凰网

3年13次修改用户隐私协议,Anthropic将全球用户数据交给美情报机构

美国硅谷正围绕AI发展的速度与安全掀起一场激烈辩论。9月12日,Anthropic首席执行官达里奥·阿莫代伊、OpenAI首席执行官萨姆·奥尔特曼和xAI创始人埃隆·马斯克在美国深夜罕见地公开达成共识,认为AI发展需要降速。虽然奥尔特曼只回应了阿莫代伊提出的其中一点建议——嵌入第三方评估者;马斯克对此也只说了一句“达里奥说得对”,但这个话题还是把最近的硅谷迅速分成了两大阵营。另一边,英伟达首席执行

09/19
DealStreetAsia

Anthropic 计划在 IPO 前推出新 AI 模型

据三位知情人士透露,Anthropic正考虑推出一款新的人工智能模型,以应对OpenAI自发布GPT-6 Astra以来获得的势头。此举正值该公司预计进行IPO之前,且其CEO此前呼吁全行业放缓步伐。 知情人士称,这一潜在发布旨在应对来自直接竞争对手的竞争压力,其时机紧随Anthropic CEO达里奥·阿莫代伊呼吁全球AI社区放缓发布新能力的步伐以解决安全担忧之后。 “我们必须放缓提升AI模型能

09/19 全文见 连线
cnbeta

Anthropic首席执行官呼吁放缓前沿AI开发 拟建立三层安全机制

Anthropic首席执行官达里奥·阿莫代伊呼吁控制前沿人工智能模型能力提升的速度,为安全评估和防护措施争取时间。他提出引入常驻独立评估人员、协调主要开发商的安全标准,并推动跨国风险管控合作。 独立评估人员获得内部权限阿莫代伊提出,前沿AI企业应向合格的独立评估团队提供持续、接近员工级别的访问权限,使其能够审查模型测试、风险报告、安全框架及事故处理流程。 Anthropic承诺率先实施该措施。外部

09/14
法国世界报

Anthropic称已阻止其AI被滥用于支持生物武器

电脑屏幕上的Anthropic网站,2026年2月26日。

09/11
路透社

Breakingviews - 评论:Anthropic的IPO是对AI的关键考验

Claude制造商的公开上市正在推迟,这推迟了大型科技公司的关键时刻。巨额收入积压依赖于该公司5000亿美元的承诺。 最终看到潜在的经济效益将影响投资者对继续投资于淘金热的容忍度。

09/24 受限 全文见 彭博社
TheVerge

Anthropic发布Claude Opus 5.5,加强网络安全防护

Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多

09/23
星洲日报

对AI安全疑虑“末日”警告 也难浇熄投资热情 放缓IPO步伐

Anthropic首席执行员阿莫戴上周末呼吁应放慢先进AI的开发脚步,但未提IPO。(路透社照片) (旧金山18日法新电)尽管近期出现了诸多关于人工智能(AI)恐会“毁灭”人类的末日警告,美国人工智能(AI)独角兽Anthropic仍有望在今年晚些时候通过首次公开募股(IPO),抢在竞争对手OpenAI之前上市,其上市规模有望成为史上最大之一,但AI公司的商业模式以及监管机构是否应介入的问题依然备

09/18
TheVerge

Anthropic 本周因网络安全问题陷入舆论漩涡

在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”

09/12
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…