字号 ·· | 护眼
财新

Anthropic推新模型Claude Opus 5.5 大幅降低综合成本

北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。图:视觉中国

北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。图:视觉中国

  【财新网】硅谷大模型竞争不停步。北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。Anthropic介绍,该模型在大多数任务上的表现与上次发布的Claude Fable 5.1相当,而运行成本较Opus系列中的上一个模型Opus 5低40%。

  在第三方AI评测榜单Artificial Analysis上,Opus 5.5居于榜首,其后是Claude Fable 5.1和OpenAI的GPT-6 Astra。

  在9月22日的介绍中,Anthropic称,Opus 5.5性能较Opus 5有明显提升,一名测试者使用它在不到一天内完成了68万行代码的迁移,这项工作原本可能需要一个工程团队耗费数周时间。

  成本和速度方面,Opus 5.5的部署所需算力低于Opus 5,定价也相应下调。测试显示,在默认设置下,Opus 5.5处理典型工作负载的成本比Opus 5低40%。其输入和输出价格分别为每百万个token 4美元和20美元,较Opus 5低20%;缓存读取价格为每百万个token 0.20美元,较Opus 5低60%。与之相比 ,Fable 5.1的价格仍然较贵,每百万个输入token收费10美元,每百万个输出token收费50美元。

  Anthropic创始人及CEO达里奥·阿莫代伊(Dario Amodei)刚在9月12日呼吁,必须放缓人工智能(AI)模型能力的提升速度。他发布博客称,AI自我改进速度加快,“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力”。(详见《Anthropic:AI“吹哨人”背后》)

  Anthropic在发布Opus 5.5时也意识到这一点,称Claude Opus 5.5是Anthropic提出放缓模型推进节奏后发布的首个模型,Claude Opus 5经过了Frontier Design和METR等外部评估机构测试。

  Anthropic称,安全方面,Opus 5.5在自动化行为审计中取得了迄今所有模型中的最高分。由于Opus 5.5的生物学和网络安全能力较高,因此,经过审核的机构才可申请使用Opus 5.5开展生物学研究。

  Anthropic近来发布新模型和降成本的速度都越来越快。7月24日,Anthropic发布了Claude Opus 5,称智能水平接近上一个模型Claude Fable 5的前沿能力,而价格仅为Fable 5的一半。9月2日早晨,Anthropic又推出Claude Fable 5.1与Claude Mythos 5.1,称两款模型是当前全球面向编程与知识工作领域能力最强的模型。(详见《Anthropic发新模型Opus 5》《Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化》)

  Anthropic在海内外的竞争者们也未停下脚步。就在北京时间9月22日,小米(01810.HK)发布并开源Xiaomi MiMo-V2.6系列模型。据发布公告,得益于RL(强化学习)算力的扩展,MiMo-V2.6-Pro在主流第三方测评平台Artificial Analysis的综合智能指数中取得46分,超过Kimi K3和Qwen3.8 Max,成为当前最强的开源模型及国产模型。(详见《小米开源新模型MiMo-V2.6 为海外同等智能模型价格1/20至1/60》)

  另一面,Meta在9月8日发布的个人AI智能体Muse推出两周后登上苹果应用商店榜首。CNBC引用的移动数据调研机构Sensor Tower数据显示,Muse上线后五天内下载量就超过了ChatGPT,成为美国iOS平台下载量最高的免费应用,截至9月21日,Muse累计下载量超过250万次;在上线后的13天内,Muse的下载量超过了Claude和Grok。