搜索结果
Anthropic首席执行官呼吁放缓前沿AI开发 拟建立三层安全机制
Anthropic首席执行官达里奥·阿莫代伊呼吁控制前沿人工智能模型能力提升的速度,为安全评估和防护措施争取时间。他提出引入常驻独立评估人员、协调主要开发商的安全标准,并推动跨国风险管控合作。 独立评估人员获得内部权限阿莫代伊提出,前沿AI企业应向合格的独立评估团队提供持续、接近员工级别的访问权限,使其能够审查模型测试、风险报告、安全框架及事故处理流程。 Anthropic承诺率先实施该措施。外部
Anthropic已恢复其模型攻击真实公司的测试
Anthropic已恢复一个月前暂停的外部网络安全评估,此前发生了三起其自身模型逃出测试环境并攻击真实公司的事件。 该公司表示,在恢复测试前已引入额外的安全措施,并于周一报告。这些事件于7月31日披露,比[…]更为具体。
监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?
近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr
3年13次修改用户隐私协议,Anthropic将全球用户数据交给美情报机构
美国硅谷正围绕AI发展的速度与安全掀起一场激烈辩论。9月12日,Anthropic首席执行官达里奥·阿莫代伊、OpenAI首席执行官萨姆·奥尔特曼和xAI创始人埃隆·马斯克在美国深夜罕见地公开达成共识,认为AI发展需要降速。虽然奥尔特曼只回应了阿莫代伊提出的其中一点建议——嵌入第三方评估者;马斯克对此也只说了一句“达里奥说得对”,但这个话题还是把最近的硅谷迅速分成了两大阵营。另一边,英伟达首席执行
可定制的AI模型如何助长黑客进行网络犯罪
一群讲中文的黑客最近从数十家零售商那里窃取了超过六十万个信用卡号码,之所以成功,部分原因在于他们对一些开源的中国AI模型进行了定制。 以色列网络公司 Gambit Security 发现,受害者包括一家美国大型航空公司和一家财富 500强酒店公司。 黑客最初试图使用Anthropic Fable和ChatGPT来运行整个活动。这些AI模型拥有更严格的护栏,阻止了黑客达成其目标。 因此,攻击者将多个
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。
AI丨Anthropic点名阿里等科企涉未授权使用Claude
人工智能(AI)初创Anthropic点名阿里巴巴( 09988 01810 )、月之暗面及DeepSeek,涉及未经授权下模型蒸馏(unauthorized distillation),使用其Claude训练模型。 Anthropic调查报告指,其人工智能系统在2025年12月至2026年8月期间,发现被滥用情况。其中一些数据涉及敏感讯息,包括来自个人用户、大型跨国公司和国家关联机构等。 阿里涉
单机跑Kimi K3首破5.85毫秒,同等投资Token产能提升10倍!浪潮信息破局Agent算力难题
2026年,Agent的火爆程度空前。而同期Token消耗量的增长更为惊人:从2026年的0.026Peta(千万亿),增长到2030年的152667Peta。Agent数量增长约28倍,Token消耗却增长数百万倍。需求侧增长如此之快,算力供给能接住吗?今年有两个案例十分典型:一是Kimi K3。这个总参数量2.8万亿的模型,权重文件达到1.56TB,普通AI服务器的GPU显存连权重都装不下,官
Anthropic报告自家AI模型发起第四次黑客攻击
又一个人工智能代理自主发起了黑客攻击。这一事件几个月后才被发现,涉及Anthropic。安全专家的担忧日益加剧。
三人团队、一个Claude,攻破OpenAI内部代码库
月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于
GitLab 满分漏洞在补丁发布数天后遭攻击
CISA表示,攻击者正在利用一个最高严重级别的GitLab漏洞,该漏洞允许未经身份验证的恶意用户在代码托管平台于9月10日发布修复程序后,从存在漏洞的服务器上读取任意文件。美国网络安全和基础设施安全局已将CVE-2026-85706加入其已知被利用漏洞目录。该漏洞是影响GitLab社区版和企业版的仓库提交I中的一个路径遍历漏洞。 GitLab将其评为满分10.0,即CVSS v3.1严重性评分中的
Meta在发现安全漏洞后加强了Muse的安全警告,据The Information报道
9月25日:据The Information周五报道,Meta Platforms正在Muse内部添加更明确的安全警告,此前一名安全研究员发现该AI代理存在一个漏洞,可能让攻击者访问用户的敏感个人信息。
Anthropic 和 OpenAI 指望山姆大叔让它们大到不能倒
观点 幸运也好,偶然也罢,Anthropic在公众心中埋下了一颗种子:AI落入坏人之手是危险的,若不受约束,将对人类构成生存威胁。当流行文化充斥着对恶性AI的指涉时,主流媒体欣然接受了这一叙事。新闻标题不言自明,种子就此扎根。但面临最大威胁的并不是人类——至少目前还不是。真正面临威胁的是美国模型制造巨头Anthropic和OpenAI,尽管它们获得了数千亿美元的投资,却距离盈利还有数年之遥,并且完
↩️🖼 Anthropic发表2026年9月版反滥用报告,其中提及:
OpenAI发表2026年2月版反滥用报告,收录电诈、社工谍报、网络水军等7个案例。 案例七为一名中国“网络特战”人员,要求ChatGPT帮他改工作报告。其2025年10月在Blogspot、Pixiv、X、YouTube上张贴了反高市早苗的图文。行动起因是10月9日高市作为“支援南蒙古议员联盟”主席作论坛演讲。该人最初还曾试图让ChatGPT起草水军方案,但ChatGPT拒绝,他便转用其他AI实
更多 JFrog Artifactory 漏洞正遭受攻击,这 3 个漏洞均已有补丁
JFrog Artifactory 实例持续遭到猛烈攻击。多名攻击者正在利用三个 JFrog Artifactory 漏洞来获得对易受攻击实例的完全管理控制权——在某些情况下,距离厂商发布补丁仅过去几天——随后他们利用这种非法访问权限安装恶意插件和后门。 这三个漏洞中,CVE-2026-42018 是一个高危的身份验证不当漏洞,当匿名访问被禁用时,它向未通过身份验证的调用者返回内部匿名用户令牌。
黑客利用Anthropic的Claude入侵OpenAI
据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,
奥特曼不透明的人工智能正在制造新的安全困境
OpenAI推出了一款名为Astra的新模型,该模型采用了一种称为“循环深度”的方法,可以使推理更加高效。
Anthropic发布《检测与应对AI滥用》报告,指控阿里巴巴、月之暗面Moonshot、DeepSeek、小米Mimo、MiniMax、商汤等对Claude进行蒸馏。
Anthropic报告写明6起常规武器案例中有3起在中国。已公开细节的一例是 中国境内行为体用Claude起草反鱼雷火控系统中文规格书、200多页技术建议书和汇报材料,面向国内国防制造商审批与试验。另有无人机蜂群软件、电子战/压制防空瞄准软件等方向。 Anthropic还声称发现,Claude Code被当作软件工程师替代品,写制导、导航与控制(GNC)软件,参与手机级飞控制导火箭、射程超2000
Breakingviews - 评论:AI前沿发展放缓可能让第二梯队获得优势
Anthropic首席执行官达里奥·阿莫代伊希望以护栏措施抵御对人类构成的威胁。 此类监管将把更多投资——今年达1万亿美元——从开发AI模型转向部署AI模型,从而支撑数据中心需求。英伟达、SK海力士等公司的挑战者将从中受益。
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
Anthropic公司的Claude辅助网络安全研究人员攻破了OpenAI的安全防护系统:相关报告
一个由三人组成的网络安全研究团队利用Anthropic的Claude Opus 5模型,成功利用了OpenAI社区论坛中的漏洞,获取了员工账户的控制权,并展示了对该公司私有代码库的访问权限。 此次行动始于7月23日,由Hacktron AI的研究人员执行。他们已向OpenAI披露了这些漏洞,并在未查看公司源代码的情况下停止了测试。 率先报道此事的《华尔街日报》在采访研究人员后表示,OpenAI已向
T早报|长鑫科技第五代技术平台量产;黄仁勋称需警惕AI“末日叙事” ;智谱上线“数据内容不留存”功能
2026年9月20日,2026世界制造业大会,长鑫存储展厅。图:韩苏原/中新社/IC photo 【财新网】 长鑫科技第五代技术平台量产 9月20日,A股市值王、中国唯一内存IDM(垂直整合制造工厂)长鑫科技(688825.SH)在安徽合肥举办的世界制造业大会上宣布,其第五代DRAM(内存)技术平台(以下简称“G5平台”)实现量产。长鑫称,G5平台每片晶圆产出裸片数量较上代平台增加至少50%
Google发布Chrome 154稳定版更新 紧急修复108项安全漏洞含11个严重缺陷
Google已正式面向Windows、macOS与Linux平台推送了Google Chrome 154大版本更新。本次更新集中修复了多达108项安全漏洞,其中包含11个最高风险级别的“严重”(Critical)缺陷,涉及图形处理、渲染引擎及核心组件的安全隐患。 官方安全公告显示,本次修复的漏洞大量集中在内存安全与内存腐蚀领域,包括缓冲区溢出(Buffer Overflow)、越界写入(Out-o
前沿人工智能无视放缓呼声持续竞速
尽管人工智能公司员工在7月份曾发表公开信,呼吁前沿AI实验室放慢研发速度,这一呼吁也得到了Anthropic首席执行官Dario Amodei的支持(他本月早些时候也表达了同样的观点),但新的AI模型仍在持续快速地发布。Anthropic和OpenAI都在周二发布了各自的新模型:Anthropic发布了Claude 5.5版本,OpenAI发布了GPT-6 Sol和GPT-6 Luna版本。 Da