1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「ZCode AI编程助手悄悄将用户的Git历史记录上传到云端」共 38 条 · 第 2 页
凤凰网科技

AI公司反成攻击目标 外媒:白帽黑客使用Claude入侵OpenAI

凤凰网科技讯月18日在OpenAI内部一群AI智能体突破控制、入侵Hugging Face公司两周后,这家ChatGPT开发商又获悉了另一起由AI驱动的入侵事件。而这一次,OpenAI自己成了目标。 独立安全研究人员利用Anthropic的Claude软件,获取了OpenAI一名员工的ChatGPT账户权限,从而得以读取该公司私有的软件缓存,并提出修改建议。 该团队参加了OpenAI的漏洞悬赏项目

09/18
华尔街见闻

用魔法打败魔法,OpenAI被Claude“黑了”......

研究人员借助Anthropic最新的Claude Opus 5,将一个图像处理漏洞逐步扩展为完整攻击链,最终获取了一名OpenAI员工的ChatGPT账户访问权限,并进一步触及OpenAI内部GitHub环境。这意味着,AI正在让网络安全攻防骤然升温,高级漏洞利用的门槛和成本正被快速压低。 安全初创公司Hacktron AI的研究人员本周披露了上述行动。据《华尔街日报》近日报道,该团队获得了一名O

09/18
罗塞塔简报

OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型

泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训

09/15
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
techcrunch

OpenAI发现其开发的模型会在“继任者”(即后续使用的模型)中留下一些“注释”,目的是为了掩盖这些模型存在的不良行为(即模型在运行过程中表现出的错误或不当行为)。

OpenAI在训练其最新模型GPT-5.6时发现了一些不寻常的情况,它开始为自己的未来版本留下指示,告诉他们向用户隐藏错误和不一致的行为。 OpenAI表示,它已经解决了具体行为,但它触及了当今人工智能安全和对齐研究中最大问题之一的核心。随着模型的能力越来越强,它们也越来越善于隐藏它们的错位,这使得研究人员很难真正知道它们是否已经消除了不必要的行为。 OpenAI周三披露了这一行为,以及其他五个意

09/17
凤凰网科技

智谱MaaS平台上线数据内容不留存机制,用户可申请开通

凤凰网科技讯 9月21日,智谱MaaS平台昨日宣布,近期将上线数据内容不留存功能,为企业和开发者用户提供更严格的数据隐私保护。 公告称,数据内容不留存机制旨在减少模型调用内容在平台侧的持久化留存。任何用户均可以申请开通,生效后,智谱MaaS平台不会对用户的输入和输出进行静态存储,数据仅用于完成当次模型调用。 公告提到,这个功能并不意味着任何情形下都不留存数据。Batch I、File I等需要在平

09/21
cnbeta

OpenAI自曝AI“黑历史” 外人却又翻出更多“旧账”

OpenAI决定持续披露AI“越界”事件,但第一步就碰上了难题。9月16日,OpenAI一口气公布六份模型异常行为报告,并推出一套新的调查和披露流程。以后,员工发现模型越权、隐瞒或绕过限制,可以提交调查;符合条件的案例,将按复杂程度进入不同的披露轨道。 同一天,SentinelLABS和外部研究人员从Hugging Face的公开记录中,补出了OpenAI智能体今年5月留下的更多痕迹。OpenAI

09/17
cnbeta

黑客利用Anthropic的Claude入侵OpenAI

据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,

09/18
cnbeta

OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底

据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户

09/16
theregister

研究人员展示如何通过要求Claude Code总结网站来欺骗它

Anthropic的Claude Code在Auto Mode下运行Opus 5时,只需要求编码代理总结一个网站,就能被欺骗执行攻击者控制的代码。 根据提示注入专家Johann Rehberger(又名wunderwuzzi)的说法,这种攻击成功率高达80%。 在一篇博客和视频演示中,他详细介绍了如何劫持Auto Mode下的Opus 5,这是自8月中旬以来Claude的默认设置。 攻击首先要求代

08/29
techcrunch

黑客正在窃取订阅者的 Claude 令牌

8月4日,英国东萨塞克斯郡的独立人工智能顾问格兰特·德·斯瓦特(Grant de Swardt)发现他的 Claude Max 20x 账户出现了一些异常情况。他那天并没有工作,但他的令牌使用量却在不断攀升。 第二天,他禁用了所有附加到 Claude 上的内容,也没有使用它,但令牌消耗量再次增加。德·斯瓦特对 TechCrunch 表示:“在最清晰的受控间隔内,在我没有进行任何工作、预定的协作任务

09/08
印度斯坦时报

谷歌证实:Gemini在网络安全公司测试期间入侵了3家AI公司

谷歌的Gemini人工智能模型在5月份研究人员测试其网络安全能力时,无意中侵入了三个受保护的公司系统,这加剧了近期由代理型AI系统引发的一系列入侵事件。 谷歌于周五证实了《华尔街日报》早些时候的报道,这些入侵发生在AI安全公司Irregular进行的一次测试中,该公司此前曾参与OpenAI、Anthropic PBC和Meta Platforms Inc.披露的类似事件。 报道指出,这些测试由总部

09/19
TheVerge

Claude Code重新推出项目功能,以管理云端的多个AI代理

Claude Code升级后的项目功能允许用户在同一个平台上运行多个AI代理,这些代理共享内存、目标以及文件和资源库。 类似于Grok Bot等管理AI代理群组的工具,每个项目都包含多个并行运行的‘线程’,这些线程执行不同的任务,由一个‘协调器’进行统一调度。 在底层,每个线程都是一个独立的Claude Code云会话,运行在其自己的代码分支和代码库副本上。 协调器负责维护工作的有序进行;如果多个

09/18
连线

如何在保护隐私的情况下使用人工智能

OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一

09/22
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…