搜索结果
研究人员展示如何通过要求Claude Code总结网站来欺骗它
Anthropic的Claude Code在Auto Mode下运行Opus 5时,只需要求编码代理总结一个网站,就能被欺骗执行攻击者控制的代码。 根据提示注入专家Johann Rehberger(又名wunderwuzzi)的说法,这种攻击成功率高达80%。 在一篇博客和视频演示中,他详细介绍了如何劫持Auto Mode下的Opus 5,这是自8月中旬以来Claude的默认设置。 攻击首先要求代
三人团队、一个Claude,攻破OpenAI内部代码库
月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于
Codex和Claude Code都跑偏了,前OpenAI研究员称Jev出现前AI世界是个悲剧
“它会逐渐退到软件背景中,像数据库、正则表达式或其他基础设施一样,成为开发者随手调用的普通能力。” 这是 TypeSafe CEO、Jev 创始人 Diogo Almeida 对 AI 的设想:当智能真正融入软件,用户甚至不必意识到它的存在。但怎样才能让开发者放心地把判断交给 AI,而不用守在旁边反复检查? 几个月前,在 AI Engineer 大会的演讲中,这位曾参与 OpenAI Instru
Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看
IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。
独家报道 | 黑客利用Anthropic的Claude入侵OpenAI
一个专注于漏洞排查的独立安全研究团队利用Anthropic的Claude软件,成功入侵了一位OpenAI员工的ChatGPT账户,从而获得了该公司私有软件缓存系统的访问权限,得以阅读并建议修改相关代码。这一事件揭示了自动化网络威胁日益严重的风险。