字号 ·· | 护眼
techcrunch

Anthropic发布Opus 5.5,价格更低,性能达到Fable级别

Anthropic 公司的最新模型 Opus 5.5 于周二正式发布,该公司表示,该模型在编码能力和知识处理性能方面达到了新的行业标准。在 Anthropic 的三款 Claude 系列模型中,Opus 是功能最强大、价格也最高的模型;Sonnet 位于中间位置,而 Haiku 则是速度最快、价格最低的模型。值得注意的是,Anthropic 表示,Opus 5.5 在许多测试基准测试中的表现均优于更强大的 Fable 模型,并且成功完成了 Fable 无法完成的一些非正式任务。

与之前的模型相比,Opus 5.5 的价格大幅降低:每生成一百万个输出结果所需的费用为 20 美元,而之前的模型费用为 25 美元。其他相关指标也显示出类似的价格下降趋势;此外,该模型的运行速度也更快,这表明支持其运行的计算资源需求有所减少。

新版本在模型的沟通方式上也进行了显著改进:Opus 5.5 更少使用专业术语,更倾向于将重要信息放在消息的开头部分。

此次发布距离 Opus 5 的首次发布仅过去了两个月(Opus 5 于 7 月 24 日发布)。根据公告,后续推出的 Sonnet 5.5 和 Haiku 5.5 也将在“未来几周内”发布,它们的性能也会有所提升。

Anthropic 表示,Opus 5.5 在生物技术和网络安全方面的能力与 Mythos 模型相当,因此其使用同样受到公司制定的安全限制。这些安全措施旨在防止这些模型被用于发现程序中的漏洞或开发具有攻击性的生物武器等用途。

Opus 5.5 是 Anthropic 自 CEO Dario Amodei 接受“放缓 AI 技术发展速度”的建议以来的首个新模型发布。Amodei 认为,有必要将 AI 技术的发展速度与人类在道德和伦理方面的进步保持同步。

“我越来越确信,要彻底应对这些风险,就需要更加谨慎的态度,”阿莫代(Amodei)在本月早些时候的一篇帖子中写道,“不仅要投资于风险预防措施,还要控制技术发展的速度,确保风险预防措施有足够的时间来跟上技术发展的步伐。”Opus 5.5的安全培训内容与其前代产品基本相同,仍包括由外部机构(如 METR 和 Frontier Design)进行的兼容性测试和发布前的评估。不过 Anthropic 表示,他们正在为未来的模型开发更先进的安全培训和评估系统,包括改进的安全防护机制和监控系统。

“随着人工智能能力的不断提升,公共政策在确保人们所依赖的系统安全方面应发挥更重要的作用。这样的安全体系需要时间来建立,我们已经开始着手构建相应的基础设施,”这篇博客文章中写道,“我们预计很快会分享更多关于这些工作的细节。”