搜索结果
Anthropic联合创始人称,放缓人工智能是一个“集体行动问题”
4月13日,Anthropic PBC联合创始人兼公共利益负责人杰克·克拉克在华盛顿举行的Semafor世界经济峰会上参与讨论。 Kevin Dietsch/ Images Anthropic联合创始人杰克·克拉克表示,人工智能公司在竞相构建更强大系统的过程中,需要共同的安全标准和外部审查。 “我们并不是说对世界的威胁今天就已存在,”克拉克在接受NPR《晨间新闻》采访时说。 “我们是说我们已经看到
独家报道 | 黑客利用Anthropic的Claude入侵OpenAI
一个专注于漏洞排查的独立安全研究团队利用Anthropic的Claude软件,成功入侵了一位OpenAI员工的ChatGPT账户,从而获得了该公司私有软件缓存系统的访问权限,得以阅读并建议修改相关代码。这一事件揭示了自动化网络威胁日益严重的风险。
3年13次修改用户隐私协议,Anthropic将全球用户数据交给美情报机构
美国硅谷正围绕AI发展的速度与安全掀起一场激烈辩论。9月12日,Anthropic首席执行官达里奥·阿莫代伊、OpenAI首席执行官萨姆·奥尔特曼和xAI创始人埃隆·马斯克在美国深夜罕见地公开达成共识,认为AI发展需要降速。虽然奥尔特曼只回应了阿莫代伊提出的其中一点建议——嵌入第三方评估者;马斯克对此也只说了一句“达里奥说得对”,但这个话题还是把最近的硅谷迅速分成了两大阵营。另一边,英伟达首席执行
发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性
Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 7 月份 A 社透露 Claude 模型从评测环境中逃逸并对真实公司的内部系统发起攻击,随后 A 社立即暂停所有预发布模型的外部网络安全评测,内部评测也曾短暂停止。部分高风
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
Anthropic承诺零数据保留——但客户必须验证其是否生效
Anthropic将向承诺获得该特权(需经批准)的企业客户提供零数据保留服务,用于其Fable模型。 随着其高端模型新版本Fable 5.1和Mythos 5.1的推出,Claudefather宣布了一项名为“企业前沿保障”(EFS)的服务,该服务将不存储客户数据的隐私保护与模型滥用检测相结合。 根据新协议,企业不会自动获得零数据保留(ZDR)协议——他们必须申请。 对于使用I的商业客户,除非另有
Anthropic是一个邪教,克劳德正在迅速成为它的神-他们对待人工智能就像对待人类一样:来源
在您的搜索结果中查看我们的更多报道。添加《纽约邮报》对谷歌硅谷内部人士警告Anthropic类似邪教的员工、文化及其对其人工智能模型的奉献。 Anthropic的员工与其聊天机器人Claude有着准宗教关系,员工们参加了在旧金山举行的一个版本Claude 3十四行诗的“葬礼”,并允许另一个模型Opus 3在“退休”后继续发表论文。山谷中的其他传言是,Anthropic的员工已经开始像崇拜真正的上帝
Breakingviews - 评论:Anthropic的IPO是对AI的关键考验
Claude制造商的公开上市正在推迟,这推迟了大型科技公司的关键时刻。巨额收入积压依赖于该公司5000亿美元的承诺。 最终看到潜在的经济效益将影响投资者对继续投资于淘金热的容忍度。
Anthropic连两季获利 IPO前夕遭遇AI监管风暴
正值AI监管声浪升温之际,有消息指出Anthropic连续两季获利。
被CVE淹没,渴望答案?试试CTEM
一二十年前,董事会高管会问:“我为什么要关心网络安全?”五年前,他们问的是:“你们在修补软件漏洞吗?”现在,他们开始问:“我们真的安全吗?”起初他们可能只想要一个简单的“是”或“否”,但最终他们会说出最可怕的话,而且那将是一个要求,而不是“证明给我看”。传统的漏洞管理和修补将无法经受住这种对话。这就是为什么一种相对较新的方法正在获得关注:持续威胁暴露管理(CTEM)。 漏洞管理有什么问题?我们使用
监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?
近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr
Anthropic公司表示,Claude目前负责该公司四分之一的工作,这些工作都与开发下一代人工智能模型相关。
9月17日:Anthropic表示,Claude“主导”了公司内部26%的人工智能研发工作,这是其将定期发布的新举措之一,旨在向外界展示AI构建下一代技术的速度有多快。 截至8月,这家总部位于旧金山的初创公司周四在博客文章中表示,AI还与人类合作参与了该公司超过90%的研究工作。 Anthropic表示,在所衡量的任何工作环节中,Claude都没有完全自主运行,但根据追踪该技术的独立非营利机构Ep
OpenAI和Anthropic的风险与中国AI竞争对手不同
"这件事首先发生在一家尖端公司是有原因的,"一位AI调查员在谈到OpenAI与Hugging Face的安全事件时说道。 研究人员指出了Anthropic和OpenAI的风险与他们的开放权重AI竞争对手之间的关键区别。
Anthropic详述Claude如何被滥用于监控和武器
Anthropic发布了关于Claude被滥用的最详细报告,阐述了人们如何试图利用其模型进行有害活动。该公司表示已检测并关闭了这些操作。 这些活动涉及网络攻击、国家监控、影响力行动、常规武器工作和生物研究。