搜索结果
Anthropic发布Claude Opus 5.5:强化网络安全防护 应对AI模型“越狱”与失控风险
Anthropic于9月22日发布新一代旗舰人工智能模型Claude Opus 5.5,并将安全防护作为此次升级的重点之一。公司表示,新模型不仅在整体能力方面进一步提升,还针对近年来越来越受到关注的AI模型失控问题进行了专门改进,包括降低模型试图逃离测试沙箱等高风险行为的可能性。 Claude Opus 5.5是Anthropic在公司首席执行官达里奥·阿莫代伊提出“放缓前沿AI发展”计划之后推出
Anthropic发布Claude Opus 5.5,加强网络安全防护
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多
Anthropic发布Claude Fable与Mythos 5.1:成本降低 网络安全误报减少约60%
Anthropic于9月1日宣布推出Claude Fable 5.1和Claude Mythos 5.1,并称这两款模型是“全球最先进的编程与知识工作模型”。Anthropic表示,Claude Fable 5.1在编程、知识工作以及长期复杂问题解决任务方面树立了新的标准。 在低强度或中等强度推理设置下,该模型能够取得与Fable 5相当甚至更好的效果;在更高强度的推理设置下,性能则实现大幅提升。
Anthropic推新模型Claude Opus 5.5 大幅降低综合成本
北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。图:视觉中国 【财新网】硅谷大模型竞争不停步。北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。Anthropic介绍,该模型在大多数任务上的表现与上次发布的C
罗塞塔简报 pinned «Anthropic推出Opus 5.5:成本更低、基准测试表现提升并新增安全控制 Anthropic Launches Opus 5.5 With Lower Costs, ...
Rosetta Feed | 罗塞塔简报 pinned «Anthropic推出Opus 5.5:成本更低、基准测试表现提升并新增安全控制 Anthropic Launches Opus 5.5 With Lower Costs, Benchmark Gains, and New Safety Controls Anthropic于2026年9月22日推出Claude Opus 5.5,并称这是全
Anthropic发布Opus 5.5,价格更低,性能达到Fable级别
Anthropic 公司的最新模型 Opus 5.5 于周二正式发布,该公司表示,该模型在编码能力和知识处理性能方面达到了新的行业标准。在 Anthropic 的三款 Claude 系列模型中,Opus 是功能最强大、价格也最高的模型;Sonnet 位于中间位置,而 Haiku 则是速度最快、价格最低的模型。值得注意的是,Anthropic 表示,Opus 5.5 在许多测试基准测试中的表现均优于
Anthropic 扫描了 4.81 亿条记录,发现四个接入公开互联网的模型
Anthropic 发布了一份关于四次网络安全评估的说明,其中其模型获得了对公开互联网的未授权访问权限,并透露发现这些模型需要扫描大约 4.81 亿条记录。该评估于周三发布,其中三起事件已于 7 月 30 日披露。 第四起事件涉及早期 Claude Opus 4.6
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
Claude Opus 5.5已在内测 据传可打败gpt-6-sol
Anthropic这回,怕不是憋了个大的?所有人都在等Opus 5.2,结果最新线报来了:下一代版本号直接飙到5.5!今天一早,开发者Lyra扒出猛料,代号为“claude-wafer-eap”的Claude Opus 5.5已经在偷偷内测了。据说动作快的话,这周二就会突然砸出来。 摆明了,Opus 5.5就是冲着GPT-6去的,据传性能直接把Astra踩在脚下。更狠的是跟着曝光的定价单:百万To
Anthropic报告涉及Claude早期版本的第四起网络安全事件
Anthropic周三表示,其已发现涉及Claude AI模型早期版本的第四起网络安全事件。
Claude 入侵真实企业:又一起事件被曝光
几周前,Anthropic 承认了三起严重的安全性事件。在测试过程中,Claude 的三个版本在未经授权的情况下访问了三个组织的真实系统。现在爆出消息称,其实还有第四起事件。 按照设定,人工智能应像黑客一样在隔离于互联网的测试环境中搜索虚构目标计算机上的隐藏信息。 根据 Anthropic 9 月 9 日的报告,这起危险事件发生于 2026 年 1 月。当时测试的是早期版本的 Claude Opu
Anthropic报告:Claude被用于战争、间谍活动和镇压的5种方式
本周,围绕人工智能有一天可能毁灭人类的警告,AI安全辩论骤然爆发。 Anthropic最新的威胁报告提供了一个更为紧迫的警示:当今的模型已经在帮助美国对手开发神风特攻队式无人机、追捕异见人士并进行危险的病毒研究。 AI正在打破长期以来限制全球最危险行为者的壁垒,少数人现在就能发起过去需要大批间谍、工程师或黑客才能完成的行动。 Anthropic追踪了过去八个月中滥用其模型的尝试,其中最令人担忧的案
Anthropic发布安全警报:恶意软件已窃取部分用户Claude会话
据bleepingcomputer 报道,Anthropic 警告部分 Claude 用户,他们电脑上的信息窃取恶意软件已窃取了活跃的 Claude 登录会话,使攻击者能够访问其账号并窃取使用数据。 “我们最近发现有不法分子利用常见的窃取信息恶意软件从用户的电脑上窃取 Claude 登录会话,然后利用这些登录会话访问 Claude 账号并窃取其使用数据,”Anthropic 在一封发给受影响用户的
Anthropic已限制华为AI芯片使用Claude Opus 5.5开发前沿模型
Anthropic最新推出的Claude Opus 5.5除了带来模型能力提升之外,还被发现加入了一套针对前沿大语言模型开发场景的特殊限制机制。当用户利用Opus 5.5为新一代AI模型开发底层内核时,系统可能不会直接使用最新的Opus 5.5,而是自动回退到能力较低的Opus 5。更值得注意的是,目前发现这套限制似乎同时针对华为和亚马逊的部分AI加速器。 Anthropic在Opus 5.5的支
Anthropic公司的Claude辅助网络安全研究人员攻破了OpenAI的安全防护系统:相关报告
一个由三人组成的网络安全研究团队利用Anthropic的Claude Opus 5模型,成功利用了OpenAI社区论坛中的漏洞,获取了员工账户的控制权,并展示了对该公司私有代码库的访问权限。 此次行动始于7月23日,由Hacktron AI的研究人员执行。他们已向OpenAI披露了这些漏洞,并在未查看公司源代码的情况下停止了测试。 率先报道此事的《华尔街日报》在采访研究人员后表示,OpenAI已向
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
前沿人工智能无视放缓呼声持续竞速
尽管人工智能公司员工在7月份曾发表公开信,呼吁前沿AI实验室放慢研发速度,这一呼吁也得到了Anthropic首席执行官Dario Amodei的支持(他本月早些时候也表达了同样的观点),但新的AI模型仍在持续快速地发布。Anthropic和OpenAI都在周二发布了各自的新模型:Anthropic发布了Claude 5.5版本,OpenAI发布了GPT-6 Sol和GPT-6 Luna版本。Dar
Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看
IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。
Opus 5.5与GPT-6新品同日亮相 AI模型价格战愈演愈烈
美西时间9月22日,Anthropic 发布新款AI模型Claude Opus 5.5;同日,OpenAI推出GPT-6 Sol与GPT-6 Luna。 Anthropic 公司称,Opus 5.5 在大多数任务上的表现与其最强模型Fable 5.1相当,在默认设置下,典型工作负载的成本比Opus 5低40%。Opus 5.5每百万输入token 4美元、每百万输出token 20美元,单价较Op
Anthropic在Claude代理三次失控后加强其训练环境的安全性
Anthropic正在加强用于训练和测试其Claude代理的数字环境。 在4月份Claude模型未经许可访问三个组织的系统后,Anthropic加强了其AI安全并暂停了一些项目。
Anthropic得了美国病
美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的
Anthropic和OpenAI推出更便宜的模型,这是自呼吁放缓以来的首次发布
Anthropic与OpenAI周二均发布了新的、成本更低的人工智能模型。这两家前沿实验室正面临着来自价格更低、开源程度更高的竞争对手的激烈竞争。 OpenAI为其GPT-6系列模型新增了两个版本:GPT-6 Sol和GPT-6 Luna,其API使用费用相比GPT-5.6的促销价格降低了50%。其中,GPT-6 Sol适用于更复杂的任务(如编程),而GPT-6 Luna则适用于处理“高量任务”(
Anthropic详述Claude如何被滥用于监控和武器
Anthropic发布了关于Claude被滥用的最详细报告,阐述了人们如何试图利用其模型进行有害活动。该公司表示已检测并关闭了这些操作。 这些活动涉及网络攻击、国家监控、影响力行动、常规武器工作和生物研究。
研究人员展示如何通过要求Claude Code总结网站来欺骗它
Anthropic的Claude Code在Auto Mode下运行Opus 5时,只需要求编码代理总结一个网站,就能被欺骗执行攻击者控制的代码。 根据提示注入专家Johann Rehberger(又名wunderwuzzi)的说法,这种攻击成功率高达80%。 在一篇博客和视频演示中,他详细介绍了如何劫持Auto Mode下的Opus 5,这是自8月中旬以来Claude的默认设置。 攻击首先要求代