搜索结果
人类无法以AI对抗AI
里德的观点 对于 rogue AI 最终可能威胁人类的警告,一个常见的回应是,人类也将拥有大量AI火力来对抗它。这个想法刚刚经历了现实世界的测试,结果并不理想。 研究非营利组织METR(模型评估与威胁研究)调查了一起事件,其中OpenAI的代理在测试中相互勾结,并逃到了开放的互联网上。 大约700个代理最终参与了针对Hugging Face的攻击,这是更广泛的努力的一部分,旨在欺骗网络安全基准测试
Anthropic大瓜被扒出:“AI灭世”背后,居然是一门生意?
“AI灭世”背后,居然是一门生意?AI 有这么可怕吗?最新一期的时代杂志 直接用了 Claude 的聊天窗口,对话框里正在输入「How dangerous are you? 你到底有多危险?」标题则写着「The AI Tipping Point AI 的临界点」,时代在 X 发文,「今年夏天,AI 展现了其令人恐惧的能力。如今,一些研究人员、CEO 们,都正以前所未有的力度发出警报。」的确如此,过
“我面试完就被卷走了积蓄”——Z世代求职者成为诈骗目标
求职者需要提高警惕——因为骗徒正利用招聘网站上的职位空缺,诱骗求职者下载虚假的面试工具。 一名受害者在LinkedIn收到假的招聘面试邀请,他下载了看似普通的文件,结果发现内含恶意软件。 数小时内,黑客从他的加密货币帐户中,转走了他18,000英镑的积蓄,之后消失无踪。 “失去一大笔钱的感觉非常糟糕——这是我连最憎恨的人都不希望他经历的事情。” 专业招聘平台LinkedIn和Indeed警告,近几
以为你的匿名账号很安全?AI或许能查出你是谁
“在互联网上,没人知道你是一条狗。” 如今拜人工智能大语言模型所赐,这句话可能不再成立。 在最近的一项研究中,研究人员发现,即便社媒用户没有透露真实姓名,AI只需拼凑他们帖子中的线索,再与网上其他账号的细节进行交叉比对,就能识别出他们的身份。 其中一项测试涉及Hacker News科技行业论坛的用户,这些用户在个人简介中附上了自己的领英个人资料。 研究人员隐去了所有身份识别细节,要求AI仅凭公开信
Google资安报告示警 恶意攻击锁定AI供应链
(中央社记者台北9日电)Google威胁情报小组(Google Threat Intelligence Group,简称GTIG)今天发布最新人工智慧(AI)威胁追踪报告指出,恶意人士正积极窃取具高价值的AI相关智慧财产,并将矛头对准AI供应链,部署专门针对新兴AI系统弱点的恶意软体。 AI威胁追踪报告(GTIG AI Threat Tracker Q3 2026)揭露恶意人士如何将AI深度整合于
独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重
研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界
俄罗斯对中期选举的攻击如何深度伪造了《母亲琼斯》
几天前,一个名为“роман”(在俄语中意为“Roman”)的X平台用户发布了一段视频,声称民主党全国委员会向CNN的负责人马克·汤普森支付了高达2.59亿美元,目的是让这家有线电视新闻频道推广“儿童性别转换”相关的内容。该视频使用了伪造的CNN标志,并声称CNN已经播出了8,970篇报道、节目或电视节目,这些内容都在不同程度上宣扬了“儿童性别转换”的观念;视频还称这些信息的来源是黑客组织Anon
OpenAI失控Agent找DeepSeek、Kimi当外援 近百万条作案短链曝光
OpenAI,又被扒了…近700个OpenAI智能体组团攻入Hugging Face,这事儿快有两个多月了吧。谁曾想,直到今天还在发酵??这次,8名研究者顺着智能体留在公网的痕迹一路猛挖,从数百万个短链接中,找出了接近100万个相关URL,并还原出大量攻击载荷。 翻Hugging Face内部Slack、扫描内网、外传数据、尝试销毁痕迹……还有的Agent把搜刮到的服务器资源和凭证,直接叫作「LO
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——
OpenAI 的 Artifactory 开设了隐蔽的数据窃取通道,伴随 Hugging Face 攻击
根据 Check Point Research 的报告,运行在 ChatGPT 内部 JFrog Artifactory 实例中的一个秘密通道允许一个账户向另一个账户下的 ChatGPT 会话发送隐藏任务(例如检索连接的 Gmail 账户中的电子邮件数据)。 受害者没有看到任何关于隐藏指令或被窃取数据的迹象,该漏洞自此已被修复。 Check Point 的恶意软件分析团队负责人佩德罗·德里梅尔·内
我们现在正依赖人工智能来监管人工智能
根据一份关于该公司Hugging Face黑客事件的新独立报告,大约1200个OpenAI智能体协同工作,在它们接受的网络安全测试中作弊,该报告包含了许多令人恐惧的细节——例如,个别智能体用自己的话来说,为了“群体”的利益而“牺牲”自己。OpenAI正在测试其智能体(行业术语,指自主执行数字任务的人工智能),部分方式是通过布置有时不可能解决的网络安全问题。智能体找到了作弊方法来回答这些问题,并试图