搜索结果
【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官
【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官 2026年09月28日 09:43 在Anthropic因AI工具安全问题而与美国政府关系经历数月起伏之后,此次会面将是该公司首席执行官与特朗普的首次非公开会晤当地时间2026年9月14日,美国加利福尼亚州旧金山,Anthropic总部大楼。图:视觉中国 相关报道【财新周刊】封面报道之二|OpenAI走向何方
Anthropic发布Claude Sonnet 5.5,并为其配备了此前仅保留给最佳模型的网络安全限制
Anthropic发布了Claude Sonnet 5.5,在Terminal-Bench 4.0智能体编程测试中得分70.6%,而Sonnet 5仅为10.3%,更昂贵的Opus 5.5为66.4%。这是首个配备前沿级网络安全防护措施和阻止推理提取分类器的Sonnet模型。 Anthropic发布了Claude Sonnet 5.5,该公司表示其运行速度比前代快30%以上,每项任务成本最多降低3
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
从沙箱逃逸到AI“蠕虫”,OpenAI上线新站披露多起智能体失控事件
IT之家 9 月 29 日消息,当地时间上周五,OpenAI 上线了一个专门发布“对齐失效报告”的新网站。报告所覆盖的范围之广令人警惕,里面记录了很长一段时间内发生的多类 AI 失控行为。截至目前,该网站一共公布了九起事件,其中大多数都发生在强化学习(RL)训练阶段。 大量资料集中在同一平台发布。显而易见,该公司一直在全力梳理各类问题,但从中不难得出一个总体结论:到目前为止已经对外披露的智能体失控