搜索结果
Anthropic发布Claude Opus 5.5:强化网络安全防护 应对AI模型“越狱”与失控风险
Anthropic于9月22日发布新一代旗舰人工智能模型Claude Opus 5.5,并将安全防护作为此次升级的重点之一。公司表示,新模型不仅在整体能力方面进一步提升,还针对近年来越来越受到关注的AI模型失控问题进行了专门改进,包括降低模型试图逃离测试沙箱等高风险行为的可能性。 Claude Opus 5.5是Anthropic在公司首席执行官达里奥·阿莫代伊提出“放缓前沿AI发展”计划之后推出
Claude 入侵真实企业:又一起事件被曝光
几周前,Anthropic 承认了三起严重的安全性事件。在测试过程中,Claude 的三个版本在未经授权的情况下访问了三个组织的真实系统。现在爆出消息称,其实还有第四起事件。 按照设定,人工智能应像黑客一样在隔离于互联网的测试环境中搜索虚构目标计算机上的隐藏信息。 根据 Anthropic 9 月 9 日的报告,这起危险事件发生于 2026 年 1 月。当时测试的是早期版本的 Claude Opu
Anthropic承诺零数据保留——但客户必须验证其是否生效
Anthropic将向承诺获得该特权(需经批准)的企业客户提供零数据保留服务,用于其Fable模型。 随着其高端模型新版本Fable 5.1和Mythos 5.1的推出,Claudefather宣布了一项名为“企业前沿保障”(EFS)的服务,该服务将不存储客户数据的隐私保护与模型滥用检测相结合。 根据新协议,企业不会自动获得零数据保留(ZDR)协议——他们必须申请。 对于使用I的商业客户,除非另有
Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器
Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第
特朗普前人工智能事务主管告诉Anthropic和OpenAI放慢脚步,并停止索取任何回报
David Sacks告诉Anthropic和OpenAI,尽管去把控前沿节奏,但不要再寻求反垄断豁免或审批制度,理由是产品责任和市场压力已经在约束它们。欧洲在2025年2月就责任问题得出了相同结论,并从12月9日起将独立软件视为严格责任下的产品。 据ANI报道,David Sacks告诉Anthropic和OpenAI,尽管放慢脚步,不要再要求任何回报。他担任总统科技顾问委员会主席,并在3月之前
Anthropic发布AI滥用报告后 中国监管部门据报对DeepSeek和月之暗面展开调查
22/09/2026 - 15:45 据科技媒体《信息报》援引知情人士报导称,在美国人工智能企业Anthropic指控中国人工智能公司深度求索(DeepSeek)和月之暗面(Moonshot AI)将敏感用户数据传输至Claude模型后,中国互联网监管机构正对这两家公司展开调查。 此前,Anthropic在其于月初发布的题为“检测并应
Anthropic正在向评估自己的公司支付费用,并在同一份声明中表示,这并非应有的运作方式。
Anthropic已指定埃森哲为其前沿模型的首个嵌入式评估机构,双方预计将在五年内各投入至少10亿美元。Anthropic将直接资助这项工作,但在同一公告中表示,资金理应来自集中资助池或政府渠道,因为这两者目前尚不存在。埃森哲已是Anthropic最大的Claude Code部署客户,而关于嵌入式评估机构可访问何种内容、必须报告何种信息,目前仍无统一标准。 Anthropic周五表示,埃森哲将派驻
白宫要求OpenAI和Anthropic在美国审查之前,暂不向英国测试人员提供新模型
英国领导人呼吁建立一套共同的全局性原则,而白宫则寻求对新模型进行优先测试。 据一位知情人士和一名美国高级政府官员透露,白宫已要求OpenAI和Anthropic在模型经过美国政府测试之前,不要将其新的人工智能模型分享给英国政府的测试机构。这两位消息人士均被要求匿名,以便描述这一要求。 这项来自国家网络事务主任办公室的要求,使企业陷入两难境地:要么拒绝向英国AI安全研究所(AISI)提供其模型——该
罗塞塔简报 pinned «Anthropic推出Opus 5.5:成本更低、基准测试表现提升并新增安全控制 Anthropic Launches Opus 5.5 With Lower Costs, ...
Rosetta Feed | 罗塞塔简报 pinned «Anthropic推出Opus 5.5:成本更低、基准测试表现提升并新增安全控制 Anthropic Launches Opus 5.5 With Lower Costs, Benchmark Gains, and New Safety Controls Anthropic于2026年9月22日推出Claude Opus 5.5,并称这是全
Anthropic发布Claude Opus 5.5,加强网络安全防护
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多
阿莫代伊的人工智能放缓对Anthropic即将进行的首次公开募股可能意味着什么
Anthropic的IPO之路如今变得坎坷了许多。在Claude的创造者于其可能具有历史意义的上市前与潜在投资者会面之际,联合创始人兼首席执行官达里奥·阿莫代伊却在推动一个似乎与这些雄心壮志相矛盾的理念——放缓脚步。 Anthropic今年早些时候估值达9650亿美元,于6月秘密提交了IPO招股书,外界普遍预计其最早将于下个月上市。与此同时,围绕先进AI模型力量的担忧数周来不断加剧,随着越来越多研
Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看
IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。