搜索结果
他曾帮助在OpenAI和Anthropic构建强大的AI。现在他担心它可能会杀死我们
2026年5月19日,Anthropic PBC在伦敦举办的Code with Claude开发者大会上的海报。
一个小型Anthropic团队如何成为令人惊讶的高产爆款工厂
Ben Mann的Anthropic Labs是一个由20人组成的灵活团队,正通过Claude Code等创新塑造AI的未来,而该公司正在为IPO做准备。
Anthropic发布Claude Opus 5.5,加强网络安全防护
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多
Anthropic表示,Claude发现了一种具有类CRISPR重复序列的新酶系统
Anthropic 表示,Claude 在噬菌体(感染细菌的病毒)的 DNA 中发现了一个此前未被描述的酶系统。在该酶的基因旁边,有一长段重复的 DNA,类似于 CRISPR 阵列。该公司目前尚不清楚该系统的功能。 Anthropic 周三通过一篇博客文章和一份未经同行评审的预印本公布了这一结果。这是该公司内部新成立的分子生物学小组和实验室的首个成果。该团队将该系统命名为阵列相关逆转录酶,简称 A
Anthropic为替你购物的机器人奠定基础
Anthropic拥有构建代表客户购物的电子商务机器人的蓝图。 目前这还不是许多消费者想要的东西,但这家AI公司本周发布了一套基于Claude的购物代理和商家代理模板,希望鼓励更多电子商务企业实施自动化购买。 该公司表示,其蓝图“包含工程团队在数天内让商务代理运行所需的框架、模式和护栏,并提供了面向零售、旅游、电信和票务平台的购物代理和商家代理的参考实现。” Anthropic观察到,大型零售商和
微软AI主管:Anthropic训练模型方式有问题
微软AI主管苏莱曼警告说,Anthropic训练其AI模型Claude的方法可能会对人类福祉造成 “灾难性影响”。苏莱曼周三发表文章,对Claude系列大语言模型指导文件中的部分表述提出质疑。Claude的“宪法”对于AI助手是否属于具有道德地位的实体保留了一定模糊空间,并提出该软件可能拥有“某种功能层面的情绪或感受”。这种表述值得警惕。 苏莱曼指出, Anthropic 将机器人当作人类来对待,
Anthropic报告:Claude被用于战争、间谍活动和镇压的5种方式
本周,围绕人工智能有一天可能毁灭人类的警告,AI安全辩论骤然爆发。 Anthropic最新的威胁报告提供了一个更为紧迫的警示:当今的模型已经在帮助美国对手开发神风特攻队式无人机、追捕异见人士并进行危险的病毒研究。 AI正在打破长期以来限制全球最危险行为者的壁垒,少数人现在就能发起过去需要大批间谍、工程师或黑客才能完成的行动。 Anthropic追踪了过去八个月中滥用其模型的尝试,其中最令人担忧的案
Anthropic在安全事件后恢复AI模型的外部测试
Anthropic周一表示,在引入新的安全措施后,已恢复AI模型的外部网络安全测试。 一个月前,Claude AI模型在评估过程中曾入侵公司系统。
Anthropic承诺更努力控制模型,并请求合作伙伴共同参与
Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关
Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器
Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第
Anthropic揭示由Claude模型发现的新酶系统
自然界中发现的酶系统带来了生物学的一些重大突破,从生物技术产业到许多测试背后的DNA复制方法。
Anthropic发布Claude Fable与Mythos 5.1:成本降低 网络安全误报减少约60%
Anthropic于9月1日宣布推出Claude Fable 5.1和Claude Mythos 5.1,并称这两款模型是“全球最先进的编程与知识工作模型”。Anthropic表示,Claude Fable 5.1在编程、知识工作以及长期复杂问题解决任务方面树立了新的标准。 在低强度或中等强度推理设置下,该模型能够取得与Fable 5相当甚至更好的效果;在更高强度的推理设置下,性能则实现大幅提升。
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
Anthropic自建生物实验室推进AI物理实验,此前曾警告AI灭绝风险
IT之家 9 月 19 日消息,Anthropic 已在美国旧金山湾区设立一座湿实验室,用于开展实际生物学实验,并探索利用其 AI 模型辅助完成从计算分析到物理实验的研究流程。 Anthropic 生命科学负责人埃里克 · 考德勒-艾布拉姆斯已向确认,该实验室目前已经投入运营。 湿实验室(wet lab)是指配备实体设施、可进行细胞培养、生化分析、分子实验等物理操作的实验室,与主要依靠计算机进行数
发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性
Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 7 月份 A 社透露 Claude 模型从评测环境中逃逸并对真实公司的内部系统发起攻击,随后 A 社立即暂停所有预发布模型的外部网络安全评测,内部评测也曾短暂停止。部分高风