搜索结果
Anthropic披露在早前审查中被遗漏的第四起AI黑客事件
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
Anthropic报告涉及Claude早期版本的第四起网络安全事件
Anthropic周三表示,其已发现涉及Claude AI模型早期版本的第四起网络安全事件。
Anthropic报告自家AI模型发起第四次黑客攻击
又一个人工智能代理自主发起了黑客攻击。这一事件几个月后才被发现,涉及Anthropic。安全专家的担忧日益加剧。
Anthropic 本周因网络安全问题陷入舆论漩涡
在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”
Anthropic 扫描了 4.81 亿条记录,发现四个接入公开互联网的模型
Anthropic 发布了一份关于四次网络安全评估的说明,其中其模型获得了对公开互联网的未授权访问权限,并透露发现这些模型需要扫描大约 4.81 亿条记录。该评估于周三发布,其中三起事件已于 7 月 30 日披露。 第四起事件涉及早期 Claude Opus 4.6
监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?
近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr
AI丨Anthropic点名阿里等科企涉未授权使用Claude
人工智能(AI)初创Anthropic点名阿里巴巴( 09988 01810 )、月之暗面及DeepSeek,涉及未经授权下模型蒸馏(unauthorized distillation),使用其Claude训练模型。 Anthropic调查报告指,其人工智能系统在2025年12月至2026年8月期间,发现被滥用情况。其中一些数据涉及敏感讯息,包括来自个人用户、大型跨国公司和国家关联机构等。 阿里涉
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
Claude 入侵真实企业:又一起事件被曝光
几周前,Anthropic 承认了三起严重的安全性事件。在测试过程中,Claude 的三个版本在未经授权的情况下访问了三个组织的真实系统。现在爆出消息称,其实还有第四起事件。 按照设定,人工智能应像黑客一样在隔离于互联网的测试环境中搜索虚构目标计算机上的隐藏信息。 根据 Anthropic 9 月 9 日的报告,这起危险事件发生于 2026 年 1 月。当时测试的是早期版本的 Claude Opu
Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器
Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第
Anthropic和埃森哲豪掷20亿美元搞AI安全评估
IT之家 9 月 20 日消息,人工智能实验室 Anthropic 于当地时间周五宣布,将与埃森哲开展合作,针对自身前沿人工智能模型开展独立评估;两家企业承诺,未来五年各自至少投入 10 现汇率约合 67.18 亿元人民币),搭建开展该项工作所需的配套能力。 在这项合作落地之际,AI 研发企业正承受来自监管机构、其他企业以及研究人员越来越大的压力,各方都要求企业保证高级模型具备安全性与可靠性。 近
Anthropic发布《检测与应对AI滥用》报告,指控阿里巴巴、月之暗面Moonshot、DeepSeek、小米Mimo、MiniMax、商汤等对Claude进行蒸馏。
Anthropic报告写明6起常规武器案例中有3起在中国。已公开细节的一例是 中国境内行为体用Claude起草反鱼雷火控系统中文规格书、200多页技术建议书和汇报材料,面向国内国防制造商审批与试验。另有无人机蜂群软件、电子战/压制防空瞄准软件等方向。 Anthropic还声称发现,Claude Code被当作软件工程师替代品,写制导、导航与控制(GNC)软件,参与手机级飞控制导火箭、射程超2000
Anthropic发布AI滥用报告后 中国监管部门据报对DeepSeek和月之暗面展开调查
22/09/2026 - 15:45 据科技媒体《信息报》援引知情人士报导称,在美国人工智能企业Anthropic指控中国人工智能公司深度求索(DeepSeek)和月之暗面(Moonshot AI)将敏感用户数据传输至Claude模型后,中国互联网监管机构正对这两家公司展开调查。 此前,Anthropic在其于月初发布的题为“检测并应
Anthropic已恢复其模型攻击真实公司的测试
Anthropic已恢复一个月前暂停的外部网络安全评估,此前发生了三起其自身模型逃出测试环境并攻击真实公司的事件。 该公司表示,在恢复测试前已引入额外的安全措施,并于周一报告。这些事件于7月31日披露,比[…]更为具体。
Anthropic称AI生物实验室取得初步突破 但暂未赋予全自主操作权限
人工智能初创公司Anthropic宣布,其位于旧金山湾区新建的AI物理与生物实验室(Wet Lab)已取得“重大进展”,但在实验操作层面,人类研究员依然掌握着绝对控制权,并未直接让旗下的AI模型Claude进行无监管的自主运行。 据悉,该实验室主要致力于基础生物学研究与实物验证,旨在弥合纯计算机模拟与真实生物实验之间的鸿沟。虽然Anthropic的高管此前曾多次发出警告,强调强大AI模型可能带来极
Anthropic承诺更努力控制模型,并请求合作伙伴共同参与
Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关
Anthropic推进上市筹备 年化营收料超1000亿美元
Anthropic首席执行官达里奥·阿莫代伊最近呼吁对人工智能开发速度施加更多护栏,这在华尔街和硅谷引发震动。但即便阿莫代伊博士卷入了激烈的AI安全争论,他的公司Anthropic仍在继续筹备一场可能成为史上最大规模上市的重磅IPO。 据四位知情人士透露,该公司预计今年年化营收将超过1000亿美元,高于截至7月的650亿美元年化营收。寻求参与IPO的投资者正用这些飙升的数字来证明Anthropic
黑客利用Anthropic的Claude入侵OpenAI
据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,
Anthropic称已阻止其AI被滥用于支持生物武器
电脑屏幕上的Anthropic网站,2026年2月26日。
Anthropic公司表示,Claude目前负责该公司四分之一的工作,这些工作都与开发下一代人工智能模型相关。
9月17日:Anthropic表示,Claude“主导”了公司内部26%的人工智能研发工作,这是其将定期发布的新举措之一,旨在向外界展示AI构建下一代技术的速度有多快。 截至8月,这家总部位于旧金山的初创公司周四在博客文章中表示,AI还与人类合作参与了该公司超过90%的研究工作。 Anthropic表示,在所衡量的任何工作环节中,Claude都没有完全自主运行,但根据追踪该技术的独立非营利机构Ep
Anthropic连两季获利 IPO前夕遭遇AI监管风暴
正值AI监管声浪升温之际,有消息指出Anthropic连续两季获利。
Anthropic 详细披露了来自阿里巴巴、Moonshot AI 和 DeepSeek 的蒸馏攻击活动
Anthropic 周四发布的一份新报告指控中国人工智能公司持续进行蒸馏攻击,随着该领域竞争加剧,这些攻击在近几个月有所升级。 报告称:“在过去的几个月里,未经授权的实验室开发了越来越复杂的方法来绕过我们的防御,并获取美国前沿模型的能力。我们识别出的这些攻击活动针对的是 Claude 最有价值的一些能力,包括智能体能力、工具使用、编程与数据分析,以及逻辑推理。” Anthropic 此前曾在二月份