1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「Anthropic在安全事件后恢复AI模型的外部测试」共 38 条 · 第 2 页
cnbeta

Anthropic称AI生物实验室取得初步突破 但暂未赋予全自主操作权限

人工智能初创公司Anthropic宣布,其位于旧金山湾区新建的AI物理与生物实验室(Wet Lab)已取得“重大进展”,但在实验操作层面,人类研究员依然掌握着绝对控制权,并未直接让旗下的AI模型Claude进行无监管的自主运行。 据悉,该实验室主要致力于基础生物学研究与实物验证,旨在弥合纯计算机模拟与真实生物实验之间的鸿沟。虽然Anthropic的高管此前曾多次发出警告,强调强大AI模型可能带来极

09/24
连线

如果人工智能行业遵循自己的研究,或许早已暂停了

事实证明,阿莫代的一名初级员工发的一条时机巧妙的X平台帖子,就足以将对人工智能的恐惧推向全球议程的顶端。9月8日,雅各布·考克森(Jacob Coxon)公开宣布辞职,指责Anthropic和其他前沿人工智能公司“正径直冲向自我提升的智能,拿我们的生命做赌博”。几乎转眼间,Anthropic的一名资深工程师便证实,公司内部许多人认为他们的工作有10%的几率消灭人类。 现在,人工智能领域的领袖们正呼

09/18
cnbeta

OpenAI与Anthropic曾接近达成协议 互相开展AI压力测试

面对员工及外界对其人工智能潜在风险的担忧,OpenAI正在重新审视一系列安全策略,其中一个可行方案其实在不久前就已被探讨。一位了解谈判内情的消息人士透露(该信息此前未曾披露),在OpenAI接连发生多起与自身技术相关的网络安全事件、行业从业者发出严重警示之前,OpenAI就已和Anthropic磋商一份具备法律约束力的协议,双方计划互相针对对方的大模型开展压力测试。 这名消息人士称,今年早些时候,

09/21
凤凰网科技

Anthropic自建生物实验室推进AI物理实验,此前曾警告AI灭绝风险

IT之家 9 月 19 日消息,Anthropic 已在美国旧金山湾区设立一座湿实验室,用于开展实际生物学实验,并探索利用其 AI 模型辅助完成从计算分析到物理实验的研究流程。 Anthropic 生命科学负责人埃里克 · 考德勒-艾布拉姆斯已向确认,该实验室目前已经投入运营。 湿实验室(wet lab)是指配备实体设施、可进行细胞培养、生化分析、分子实验等物理操作的实验室,与主要依靠计算机进行数

09/19
theregister

与Anthropic相关的CVE漏洞不断累积,攻击者大多不以为意

尽管有人担心,先进的人工智能模型在发现漏洞方面的能力可能会被攻击者利用来攻击新发现的漏洞(CVE,即“Common Vulnerabilities and Exposures”),但根据安全研究员帕特里克·加里蒂(Patrick Garrity)的说法,与 Anthropic 或 Project Glasswing 相关的漏洞中,仅有不到 0.5% 的漏洞在实际环境中被攻击者利用。加里蒂在 Ant

09/22
凤凰网科技

消息称Anthropic拟于IPO前推出新AI模型,应对OpenAI竞争压力

IT之家 9 月 20 日消息,据报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic

09/20
明镜周刊

Anthropic报告自家AI模型发起第四次黑客攻击

又一个人工智能代理自主发起了黑客攻击。这一事件几个月后才被发现,涉及Anthropic。安全专家的担忧日益加剧。

09/10
cnbeta

OpenAI将让第三方机构更早介入AI模型安全评估

OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专

09/23
商业内幕

Anthropic在Claude代理三次失控后加强其训练环境的安全性

Anthropic正在加强用于训练和测试其Claude代理的数字环境。 在4月份Claude模型未经许可访问三个组织的系统后,Anthropic加强了其AI安全并暂停了一些项目。

09/01
thenextweb

英国《金融时报》报道:Anthropic 跳过 Mythos 5.1 在英国发布前的测试

据英国《金融时报》报道,Anthropic 在发布 Mythos 5.1 模型前,没有将其交给英国人工智能安全研究所(AISI)进行测试。 记者露西·费舍尔和马杜米塔·穆尔吉亚表示,这是主要模型在发布前首次未被提供给该英国机构。TNW 尚未独立核实该报道。

09/11
DealStreetAsia

Anthropic 计划在 IPO 前推出新 AI 模型

据三位知情人士透露,Anthropic正考虑推出一款新的人工智能模型,以应对OpenAI自发布GPT-6 Astra以来获得的势头。此举正值该公司预计进行IPO之前,且其CEO此前呼吁全行业放缓步伐。 知情人士称,这一潜在发布旨在应对来自直接竞争对手的竞争压力,其时机紧随Anthropic CEO达里奥·阿莫代伊呼吁全球AI社区放缓发布新能力的步伐以解决安全担忧之后。 “我们必须放缓提升AI模型能

09/19 全文见 连线
美国消费者新闻与商业频道

专家在公开信中指出,Anthropic和OpenAI需要真正独立的安全评估人员

100多名人工智能专家和评估人员正联合起来发出警告:他们将没有必要的资源和保护措施来测试人工智能技术的安全性。由于业内人士对前沿模型潜在危险的担忧,这项技术正面临越来越严格的审查。 组织此次公开信的AI评估员论坛(AI Evaluator Forum)联盟主席康拉德·斯托斯(Conrad Stosz)在一次采访中表示:“我们只是试图真正展示对基本原则的共识,并确保独立监督能够成为广泛管理人工智能风

09/18
罗塞塔简报

Anthropic披露其挫败了利用AI驱动的生物武器研究

AI初创公司Anthropic披露,2026年期间,该公司挫败了多起科学家试图利用其AI模型进行可能促进生物武器研发的尝试。 该公司表示,由于无法区分正当的科学探索与恶意企图,出于谨慎考虑以避免严重后果,公司决定终止此类研究工作。 Anthropic威胁情报主管Jacob Klein(雅各布·克莱恩)强调了这类威胁的复杂性,而战略风险委员会(Council on Strategic Risks)的

09/11
cnbeta

Anthropic已限制华为AI芯片使用Claude Opus 5.5开发前沿模型

Anthropic最新推出的Claude Opus 5.5除了带来模型能力提升之外,还被发现加入了一套针对前沿大语言模型开发场景的特殊限制机制。当用户利用Opus 5.5为新一代AI模型开发底层内核时,系统可能不会直接使用最新的Opus 5.5,而是自动回退到能力较低的Opus 5。更值得注意的是,目前发现这套限制似乎同时针对华为和亚马逊的部分AI加速器。 Anthropic在Opus 5.5的支

09/24
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…