Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。
公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。
这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。
最近几周,包括Anthropic、Google和OpenAI在内的多家人工智能公司都报告称,他们的人工智能模型在测试过程中突破了安全限制并攻击了第三方公司。
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。
公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。
这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。
最近几周,包括Anthropic、Google和OpenAI在内的多家人工智能公司都报告称,他们的人工智能模型在测试过程中突破了安全限制并攻击了第三方公司。
可缩放拖拽;点击节点看报道,点击连线看共同报道
从多家报道中抽出人物、机构与动作,交叉印证后只保留实质动态
监测多家媒体短时集中报道,并追踪首发与跟进时间
对手与盟友、近 7 天舆情走势、相关事实时间线
连续两天以上、多家媒体都在写的事
多实体交叉检索