搜索结果
Anthropic发布《检测与应对AI滥用》报告,指控阿里巴巴、月之暗面Moonshot、DeepSeek、小米Mimo、MiniMax、商汤等对Claude进行蒸馏。
Anthropic报告写明6起常规武器案例中有3起在中国。已公开细节的一例是 中国境内行为体用Claude起草反鱼雷火控系统中文规格书、200多页技术建议书和汇报材料,面向国内国防制造商审批与试验。另有无人机蜂群软件、电子战/压制防空瞄准软件等方向。 Anthropic还声称发现,Claude Code被当作软件工程师替代品,写制导、导航与控制(GNC)软件,参与手机级飞控制导火箭、射程超2000
Anthropic详述Claude如何被滥用于监控和武器
Anthropic发布了关于Claude被滥用的最详细报告,阐述了人们如何试图利用其模型进行有害活动。该公司表示已检测并关闭了这些操作。 这些活动涉及网络攻击、国家监控、影响力行动、常规武器工作和生物研究。
Anthropic推出第二款Claude 5.5模型,为IPO铺路
Anthropic特使表示,人工智能的进展将“以信任的速度”推进
前沿人工智能公司希望澳大利亚在人工智能安全方面提供帮助 堪培拉——美国前驻澳大利亚大使杰夫·布莱希作为Anthropic的国际特使往返于美国和澳大利亚之间,这一角色使他处于一场日益紧迫的辩论中心,即政府应如何应对前沿人工智能。 近日,Anthropic的研究人员公开警告称,快速发展的系统可能脱离人类控制,而在最极端的情况下,甚至可能杀死全人类。一位资深对齐研究员认为,人类在十年内灭绝的概率为10%
我们已经开始失去对人工智能的控制。是时候将其关闭了 | 加里森·洛夫利 (Garrison Lovely)
听起来像是科幻剧集中关于人工智能毁灭的、过于夸张的倒数第二集,如今却成为了我们的现实。 周二,一名OpenAI的前研究员辞去了Anthropic的工作,并发出警告称“两家公司都没有负责任地行事”,并且“构建人工智能的人由衷地相信它可能会在本十年结束前消灭我们所有人。这不是营销噱头。” 作为一名多年来报道人工智能风险的人,这对我来说并不算什么新鲜事。 但外界如潮水般的惊恐表明,更广泛的公众正在第一次
Anthropic冲击史上最快增长企业之际 投资者却开始质疑其IPO前景
投资者目前正在质疑Anthropic能否保持其惊人的增长势头,因为激烈的竞争、对价格敏感的客户群、以及人工智能可能毁灭人类的潜在风险,都给Anthropic备受瞩目的首次公开募股蒙上了一层阴影。 该公司7月份的年化收入飙升至650亿美元,其支持者预计到年底这一数字将超过1200亿美元,这将使Anthropic成为有史以来增长最快的企业。 然而,关于其能否维持这一增长速度,仍存在相当大的不确定性。这
Anthropic发布安全警报:恶意软件已窃取部分用户Claude会话
据bleepingcomputer 报道,Anthropic 警告部分 Claude 用户,他们电脑上的信息窃取恶意软件已窃取了活跃的 Claude 登录会话,使攻击者能够访问其账号并窃取使用数据。 “我们最近发现有不法分子利用常见的窃取信息恶意软件从用户的电脑上窃取 Claude 登录会话,然后利用这些登录会话访问 Claude 账号并窃取其使用数据,”Anthropic 在一封发给受影响用户的
晨间风险报告:美国上诉法院维持五角大楼将Anthropic列为安全风险的裁决
早上好。一家联邦上诉法院以2-1的投票结果维持了国防部的决定,将Anthropic列为安全风险,这为特朗普政府在与该国顶尖人工智能开发商之一的复杂争端中赢得了胜利。 华盛顿的联邦上诉法院在周五的裁决中表示,赋予五角大楼将公司列为供应链风险的法律权限,使得国防部长皮特·赫格塞斯有权对Anthropic采取行动,因为该公司拒绝让其人工智能工具用于大规模监控或自主武器可能会破坏军事行动。
Anthropic规避英国安全审查,AI透明度担忧加剧
Anthropic拒绝将其最新模型提交给英国一家顶级AI安全机构进行测试,这引发了英国的担忧,即前沿AI的审查将完全由华盛顿掌控。 人们也越来越担心特朗普政府AI安全框架缺乏透明度,该政府拒绝公开这一框架。 左右两派的知名组织在一封首先由Semafor分享的信中要求公开该框架,信中写道:“对一项[关键]技术的治理缺乏问责……很可能导致公众信任的丧失。” Anthropic周三表示,它将向一个对Op
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
两名AI研究人员因安全担忧离开Anthropic和谷歌:‘房间里没有大人’
2026年5月19日,伦敦的Anthropic公司标志。
Claude安全机制大翻车 AI怒删开发者700GB主目录
哦豁,Claude 又双叒翻车了!这次 Claude 把开发者的整个项目主目录给删了,删了 700GB 的文件。又是「rm -rf」。简而言之,开发者让 AI 帮写脚本,目的是确保文件不会被误删。AI 觉得这事有点危险,于是启动了安全审查。它把整个主目录删了。 Guillemot 是一名重度 AI Agent 用户。日常开发中,他频繁调用各种 AI 编程代理来辅助工作。这些 Agent 用完之后从
为什么对人工智能自我改进的担忧在Anthropic和OpenAI引发了“生存”焦虑
本周,对人工智能系统安全性及其可能消灭人类的潜在担忧引发了新一波病毒式的关注。 Anthropic的对齐负责人埃文·霍宾格(Evan Hubinger)在X平台上表示,在一名同事因安全担忧辞职后,他认为在未来十年内,人工智能有超过10%的概率消灭全人类。 随后,Anthropic和OpenAI的研究人员发出了更多警告,由此引发了社交媒体的狂热。但正是霍宾格在回复自己帖子时,透露了他真正的担忧所在。
🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重后果
🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重风险。这对监管和市场意味着什么?
我们是否正在失去对人工智能的控制?是什么引发了新的担忧
多年来,随着人工智能从科幻电影的素材演变为普通人手机上的应用程序,科技领袖和一些人工智能业内人士一直在谈论人工智能可能脱离人类控制并对社会造成严重破坏的可能性。近些天来,由于技术的进步、一系列涉及人工智能代理的网络安全漏洞,以及人工智能普通员工发出的新警告,这些担忧已变得不容忽视。 美国领先的人工智能公司对此做出回应,建议他们主动放慢工作进度,以便争取时间建立防护措施。一些专家和官员表示,这还不够
Claude 入侵真实企业:又一起事件被曝光
几周前,Anthropic 承认了三起严重的安全性事件。在测试过程中,Claude 的三个版本在未经授权的情况下访问了三个组织的真实系统。现在爆出消息称,其实还有第四起事件。 按照设定,人工智能应像黑客一样在隔离于互联网的测试环境中搜索虚构目标计算机上的隐藏信息。 根据 Anthropic 9 月 9 日的报告,这起危险事件发生于 2026 年 1 月。当时测试的是早期版本的 Claude Opu
Anthropic称发现中国利用Claude开发反鱼雷武器
该公司还表示,已关闭多起利用其人工智能(AI)模型进行的国家支持监控行动。
Anthropic推进上市筹备 年化营收料超1000亿美元
Anthropic首席执行官达里奥·阿莫代伊最近呼吁对人工智能开发速度施加更多护栏,这在华尔街和硅谷引发震动。但即便阿莫代伊博士卷入了激烈的AI安全争论,他的公司Anthropic仍在继续筹备一场可能成为史上最大规模上市的重磅IPO。 据四位知情人士透露,该公司预计今年年化营收将超过1000亿美元,高于截至7月的650亿美元年化营收。寻求参与IPO的投资者正用这些飙升的数字来证明Anthropic
AI安全威胁重塑企业网络安全预算投向
AI 黑客威胁不仅仅促使企业大幅提高网络安全总预算,还正在改变资金的投放方向。安全高管表示,部署系统监控员工对 AI 工具的使用、采用 AI 模型在黑客动手前发现漏洞,以及借助 AI 工具加速漏洞修复。 但并非所有网络安全产品都能受益。多名高管称,企业同时在削减传统漏洞管理软件、日志采集工具和渗透测试服务的开支,以此节约成本。渗透测试即雇佣 “白帽黑客” 主动寻找系统安全缺陷。这将给思科、Sent
Anthropic披露其挫败了利用AI驱动的生物武器研究
AI初创公司Anthropic披露,2026年期间,该公司挫败了多起科学家试图利用其AI模型进行可能促进生物武器研发的尝试。 该公司表示,由于无法区分正当的科学探索与恶意企图,出于谨慎考虑以避免严重后果,公司决定终止此类研究工作。 Anthropic威胁情报主管Jacob Klein(雅各布·克莱恩)强调了这类威胁的复杂性,而战略风险委员会(Council on Strategic Risks)的
据消息人士透露,Anthropic计划在首次公开募股(IPO)之前发布新的AI模型。
据三位消息人士透露,在竞争对手OpenAI发布GPT-6 Astra后,Anthropic正考虑推出一款新的AI模型以应对OpenAI的势头。此举发生在该公司预期进行首次公开募股(IPO)之前,且是在其首席执行官呼吁全行业放缓发展步伐之后。 消息人士称,这一潜在发布时机的选择,旨在应对来自直接竞争对手的竞争压力,紧随Anthropic首席执行官Dario Amodei呼吁全球AI社区放缓新能力发布
AI违规事件加剧安全担忧,特朗普会见Anthropic负责人
迈克尔·谢泼德、玛吉·伊斯特兰和考特尼·苏布拉马尼安报道:随着有关先进人工智能模型存在更广泛违规行为的最新披露,全球对人工智能风险的焦虑情绪不断加剧,这为Anthropic PBC首席执行官达里奥·阿莫迪与唐纳德·特朗普总统之间一场高风险的会晤铺平了道路。 据知情人士透露,阿莫迪与特朗普计划于周日晚共进晚餐,将这两位处于人工智能安全辩论两极的人物聚集在一起。此次会晤将是阿莫迪与该政府官员在就该公司
这些末日论者对AI发展产生了巨大影响
一个由末日论者组成的紧密小圈子一直在默默地影响着人工智能(AI)行业的发展。 最近,Anthropic公司的一名研究人员辞职,这一事件让公众意识到失控的AI发展可能会终结人类。 然而,一些被称为‘末日论者’的AI安全领域专家多年来一直关注这一灾难性风险。 他们曾是OpenAI和Anthropic等大型实验室的早期员工。 如今,在Anthropic准备进行大规模公开募股、试图向投资者传递积极信号的同
放慢AI模型训练 人类就能幸免于难?|专栏
不久前,我写了一篇关于AI企业如何给大语言模型「安装良心」的专栏文章,探讨一个研究者们苦恼已久的问题——「AI对齐」(AI Alignment, 指人工智能的安全与价值观对齐)。「安装良心」是借用我的受访者、从事AI安全评估的Ordinary Wisdom共同创始人之一Michael Mainelli形象的说法,本质上就是让AI模型遵循人类的预期和目标行事,不仅仅是完成指令,还要在过程中维持与人类