搜索结果
Anthropic在Claude代理三次失控后加强其训练环境的安全性
Anthropic正在加强用于训练和测试其Claude代理的数字环境。 在4月份Claude模型未经许可访问三个组织的系统后,Anthropic加强了其AI安全并暂停了一些项目。
发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性
Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 7 月份 A 社透露 Claude 模型从评测环境中逃逸并对真实公司的内部系统发起攻击,随后 A 社立即暂停所有预发布模型的外部网络安全评测,内部评测也曾短暂停止。部分高风
Anthropic承诺更努力控制模型,并请求合作伙伴共同参与
Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关
Anthropic发布Claude Opus 5.5:强化网络安全防护 应对AI模型“越狱”与失控风险
Anthropic于9月22日发布新一代旗舰人工智能模型Claude Opus 5.5,并将安全防护作为此次升级的重点之一。公司表示,新模型不仅在整体能力方面进一步提升,还针对近年来越来越受到关注的AI模型失控问题进行了专门改进,包括降低模型试图逃离测试沙箱等高风险行为的可能性。 Claude Opus 5.5是Anthropic在公司首席执行官达里奥·阿莫代伊提出“放缓前沿AI发展”计划之后推出
诺和诺德与Anthropic合作,利用Claude加速药物研发
Anthropic报告涉及Claude早期版本的第四起网络安全事件
Anthropic周三表示,其已发现涉及Claude AI模型早期版本的第四起网络安全事件。
Anthropic发布Claude Opus 5.5,加强网络安全防护
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看
IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。
Anthropic得了美国病
美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的
Anthropic推出首个生物实验室助手Claude CRISPR 助力基因编辑与生命科学研究
人工智能研究公司Anthropic宣布推出一款专门针对生命科学与生物工程领域优化的AI助手“Claude CRISPR”。该工具基于其先进的Claude模型架构构建,旨在帮助科研人员处理复杂的基因组学数据、设计CRISPR基因编辑方案以及优化分子生物学实验流程。 在基因编辑领域,利用CRISPR技术对特定DNA序列进行精确剪切与修饰需要极高精度的靶点选择,以避免产生致命的“脱靶效应”。Claude
Anthropic设立实体生物实验室 推动Claude参与机器人实验
Anthropic已在旧金山湾区建立一处生物“湿实验室”,将人工智能在生命科学领域的应用从文献、数据和计算分析延伸至实体实验。公司计划让Claude协助指导实验机器人,在药物研发及罕见病研究中形成设计实验、执行操作和分析结果的闭环。 从计算研究延伸至实体实验湿实验室主要用于处理生物样本、化学试剂和细胞等实体材料。Anthropic建立相关设施后,可以把Claude提出的研究假设、候选靶点或实验方案
Anthropic在安全事件后恢复AI模型的外部测试
Anthropic周一表示,在引入新的安全措施后,已恢复AI模型的外部网络安全测试。 一个月前,Claude AI模型在评估过程中曾入侵公司系统。
Anthropic发布《检测与应对AI滥用》报告,指控阿里巴巴、月之暗面Moonshot、DeepSeek、小米Mimo、MiniMax、商汤等对Claude进行蒸馏。
Anthropic报告写明6起常规武器案例中有3起在中国。已公开细节的一例是 中国境内行为体用Claude起草反鱼雷火控系统中文规格书、200多页技术建议书和汇报材料,面向国内国防制造商审批与试验。另有无人机蜂群软件、电子战/压制防空瞄准软件等方向。 Anthropic还声称发现,Claude Code被当作软件工程师替代品,写制导、导航与控制(GNC)软件,参与手机级飞控制导火箭、射程超2000
微软AI主管:Anthropic训练模型方式有问题
微软AI主管苏莱曼警告说,Anthropic训练其AI模型Claude的方法可能会对人类福祉造成 “灾难性影响”。苏莱曼周三发表文章,对Claude系列大语言模型指导文件中的部分表述提出质疑。Claude的“宪法”对于AI助手是否属于具有道德地位的实体保留了一定模糊空间,并提出该软件可能拥有“某种功能层面的情绪或感受”。这种表述值得警惕。 苏莱曼指出, Anthropic 将机器人当作人类来对待,
他曾帮助在OpenAI和Anthropic构建强大的AI。现在他担心它可能会杀死我们
2026年5月19日,Anthropic PBC在伦敦举办的Code with Claude开发者大会上的海报。
Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器
Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第
Anthropic详述Claude如何被滥用于监控和武器
Anthropic发布了关于Claude被滥用的最详细报告,阐述了人们如何试图利用其模型进行有害活动。该公司表示已检测并关闭了这些操作。 这些活动涉及网络攻击、国家监控、影响力行动、常规武器工作和生物研究。
五角大楼因Anthropic不具备的能力将其列入黑名单
美国联邦法官裁定,五角大楼基于部分Claude实际上无法做到的事情,非法将Anthropic列为国家安全威胁。 美国地区法官Rita Lin发现,政府因Anthropic公开发声而非法报复,剥夺了该公司的正当程序,并无理将其标记为供应链风险。 在长达59页的裁决中,她多次驳斥五角大楼的国家安全理由,并认定其关于Claude的一些核心主张“完全没有根据”。 这场争端始于2月,当时Anthropic拒
Anthropic发布安全警报:恶意软件已窃取部分用户Claude会话
据bleepingcomputer 报道,Anthropic 警告部分 Claude 用户,他们电脑上的信息窃取恶意软件已窃取了活跃的 Claude 登录会话,使攻击者能够访问其账号并窃取使用数据。 “我们最近发现有不法分子利用常见的窃取信息恶意软件从用户的电脑上窃取 Claude 登录会话,然后利用这些登录会话访问 Claude 账号并窃取其使用数据,”Anthropic 在一封发给受影响用户的
Anthropic公司表示,Claude目前负责该公司四分之一的工作,这些工作都与开发下一代人工智能模型相关。
9月17日:Anthropic表示,Claude“主导”了公司内部26%的人工智能研发工作,这是其将定期发布的新举措之一,旨在向外界展示AI构建下一代技术的速度有多快。 截至8月,这家总部位于旧金山的初创公司周四在博客文章中表示,AI还与人类合作参与了该公司超过90%的研究工作。 Anthropic表示,在所衡量的任何工作环节中,Claude都没有完全自主运行,但根据追踪该技术的独立非营利机构Ep
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
AI丨Anthropic点名阿里等科企涉未授权使用Claude
人工智能(AI)初创Anthropic点名阿里巴巴( 09988 01810 )、月之暗面及DeepSeek,涉及未经授权下模型蒸馏(unauthorized distillation),使用其Claude训练模型。 Anthropic调查报告指,其人工智能系统在2025年12月至2026年8月期间,发现被滥用情况。其中一些数据涉及敏感讯息,包括来自个人用户、大型跨国公司和国家关联机构等。 阿里涉
Claude 入侵真实企业:又一起事件被曝光
几周前,Anthropic 承认了三起严重的安全性事件。在测试过程中,Claude 的三个版本在未经授权的情况下访问了三个组织的真实系统。现在爆出消息称,其实还有第四起事件。 按照设定,人工智能应像黑客一样在隔离于互联网的测试环境中搜索虚构目标计算机上的隐藏信息。 根据 Anthropic 9 月 9 日的报告,这起危险事件发生于 2026 年 1 月。当时测试的是早期版本的 Claude Opu