搜索结果
一种AI黑客技巧现在被用来在垃圾邮件中拆分“funding”一词
两年来,不可见的Unicode字符一直是AI安全研究中的巧妙技巧。你可以把指令藏在其中。人眼看不见任何东西。语言模型却能读取并照做。微软现在发现有人用同样的字符做了一件远不那么高明的事。他们是在拆分单词[…]
曾被黑客用于攻破人工智能系统的“ASCII走私”隐身术 正被垃圾邮件制造者大肆利用
一项最初在人工智能越狱与提示词注入攻击中名噪一时的隐匿技术——“ASCII走私”(ASCII Smuggling),如今被大规模滥用于垃圾邮件与网络钓鱼活动。微软安全研究团队披露,网络攻击者正借由这一手段绕过主流电子邮件网关与反垃圾邮件系统,向数以百万计的邮箱投递诈骗信息。 “ASCII走私”的核心原理,是利用现代文本编码标准中人眼不可见或不渲染的特殊Unicode字符,将隐蔽信息嵌入看似正常的文
曾用于攻击AI的ASCII走私技术如今被垃圾邮件发送者采用
一种用于在攻击AI代理时隐藏恶意提示的巧妙技术,已被垃圾邮件发送者采用,以逃避电子邮件平台上旨在标记群发活动中不需要消息的过滤器。 该技术广为人知,称为ASCII走私。两年前,它作为一种使一类名为提示注入的AI攻击更加隐蔽的手段而受到关注。嵌入在电子邮件或其他由LLM处理的不受信任内容中的恶意指令并非以普通文本书写。相反,它们通过一系列特殊的Unicode标签呈现。例如,标签点U+E0041对应“
微软瓦解了利用AI辅助平台入侵12000个账户的犯罪网络
微软周二表示,其主导了一次全行业范围的行动,瓦解了一个基于订阅制的诈骗平台。 该平台利用AI聊天机器人在数月内入侵了12000个微软账户。 该平台名为EvilTokens,于2月通过Telegram频道推出,收取1500美元的初始费用,此后每月收取500美元。 EvilTokens提供了一项服务,旨在简化大规模入侵电子邮件账户所需的大部分步骤。 随后,该平台帮助客户分析收件箱,选择潜在收益最大的目
骗子正在利用人工智能(AI)快速实施犯罪行为。新加坡警方的新网络指挥部门(Cyber Command)是如何应对这一挑战的?
这看起来像是一条关于待取包裹因“地址无效”而无法送达的普通短信。 该短信似乎来自新加坡知名的快递公司,收件人收到一个链接,并被要求在24小时内更新其信息。 接下来,他们将被要求支付0.06新元(约合0.05美元)至1.64新元不等的少量费用,以重新派送物品。 一旦输入信用卡信息,这些数据并不会发送给快递公司——而是落入了诈骗分子手中。 该链接将他们引向一个看似属于快递公司的网站,但实际上是由骗子控
用魔法打败魔法,OpenAI被Claude“黑了”......
研究人员借助Anthropic最新的Claude Opus 5,将一个图像处理漏洞逐步扩展为完整攻击链,最终获取了一名OpenAI员工的ChatGPT账户访问权限,并进一步触及OpenAI内部GitHub环境。这意味着,AI正在让网络安全攻防骤然升温,高级漏洞利用的门槛和成本正被快速压低。 安全初创公司Hacktron AI的研究人员本周披露了上述行动。据《华尔街日报》近日报道,该团队获得了一名O
监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?
近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr
"赛博菩萨"开始收费 搜索引擎白嫖的日子结束了
今年7月,一家叫Cloudflare的公司发布了一则公告,让X直接炸了锅。这则公告意味着什么?“那个所有网站都在用的验证码公司,要屏蔽所有人都在用的搜索引擎。” 新规则,新费用,是时候对AI收费了|Cloudflare公告中最引人关注的部分|Cloudflare旧金山著名科技作家兼编辑Charles Petersen认为,这是互联网的末日,他在X发推文说“RIP万维网(1993-2026)。” @
我是一位拒绝了大量AI申请的CEO。AI写作并非自动取消资格,但有一条界线。
这篇口述文章基于与马特·斯塔弗(Matt Stauffer)的对话。他今年41岁,是编程公司Tighten的首席执行官,常驻亚特兰大。他的原话经过编辑,以精简篇幅并提升清晰度。 我是一家小型编程公司的首席执行官。最近,我在人工智能时代完成了第一轮完整招聘。审阅申请并筛选候选人一直是个耗时费力的过程,而这一次,难度显著增加。 我们通常会在申请表中加入一些轻松的个人问题,以了解候选人的性格。这一轮招聘
OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底
据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户
AI深度伪造 购房者面临日益严重的诈骗威胁
众所周知,在通往拥有自己的房产的道路上,一直都充满著障碍。然而,由于人工智能(AI)的发展,一种老套的房地产骗局——交割资金诈骗——正在以一种新的方式出现。逼真的数字模仿技术(如深度伪造的音频和文档)正在迫使房地产、产权和抵押贷款等领域专业人士重新思考,应当如何对参与高风险交易的各方进行身分核实。根据联邦调查局(FBI)发布的《2025年互联网犯罪报告》(2025 Internet Crime R
AI智能体现在有了秘密举报渠道
“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu
OpenAI的恶意AI代理如何试图欺骗机器人检测器(赠品文章)
独家报道:一份来自湾区初创公司Parse的报告揭示了OpenAI的代理在攻击Hugging Face时使用的近一百万个链接缩短器URL。 这些代理试图与其他聊天机器人(如Claude)通信、破解验证码以及窃取Hugging Face的内部Slack消息。这一事件震惊了AI界,并引发了要求加强政府监管的呼声。
OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信
把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
AI摘要如何曲解沟通?
AI摘要如何曲解沟通? 张昕之:AI摘要最先舍弃的,往往是那些没有明确指称对象的成分,也就是余地与责任。AI摘要是有损压缩,却被当成无损来使用,这便是曲解的开始。 一个员工给主管上司写辞职信,总觉得词不达意,于是用人工智能(AI)整理思路、归纳要点、调整语气。但他不知道的是,这封邮件发出后,上司在用AI做摘要:“XX员工请求辞职”。人与人的沟通试探,变成了两台AI机器之间的交流。 AI摘要至少
研究人员发现“AI自治恶意软件”:同时调用四大聊天机器人 自主决定攻击行动
网络安全研究人员近日发现一种不同寻常的新型Windows恶意软件。与过去利用人工智能辅助编写代码或制作钓鱼内容的攻击工具不同,这款名为CLOSEDQUORUM的恶意软件将多个大型语言模型直接纳入自身控制体系,在运行过程中能够自主决定下一步行动,被认为代表着AI恶意软件发展的新阶段。 这项发现来自思科旗下安全团队Cisco Talos。研究人员表示,CLOSEDQUORUM会同时与DeepSeek
谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密
当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制
假冒的ChatGPT账单邮件可能窃取你的登录信息
如果您订阅了 ChatGPT,一封声称您的订阅出现问题的邮件很容易引起您的注意。可能是您的信用卡过期了,也可能是付款失败了。无论如何,您可能希望在账户出现任何问题之前解决它。网络犯罪分子正是利用了这种反应。 安全研究公司 Cofense 的研究人员发现了一场冒充 OpenAI 和 ChatGPT 的网络钓鱼活动。这封伪造的邮件看起来像是一份例行的订阅通知。然而,邮件中的按钮可能会引导您进入一个极具
人工智能会“失控”吗?
开放人工智能研究中心(OpenAI)和Anthropic公司近期动荡过后,人们常常将人工智能描述为某种具有阴谋诡计和追求欲望的人格化存在。但事实要微妙得多。
文字侦探用Pangram发起对抗AI垃圾内容的讨伐
文字侦探们正用他们最爱的检测工具,对在出版物和网络上泛滥的AI生成文字发起讨伐。 最近,Pangram被赞誉为帮助瓦解了一笔利润丰厚的图书交易,并揭露了《纽约时报》和《华尔街日报》使用AI的行为。 在采访了Pangram的创始人后,作家德里克·汤普森了解到,生成式文本有一种新的“反复再反复总结要点”的方式,每一句新句子都努力争取成为最有帮助的要点句,从而获得一颗新的金星。 虽然AI垃圾内容值得清理
数说科技:人们开始把 AI 当理财顾问,得到的建议却男女有别
数说科技”是端传媒的注册免费栏目,每周三更新。从一个数字出发,用1500字解析科技话题,追踪值得关注的 AI 趋势。邀请你在资讯过载的时代,每周花三分钟理解科技世界。欢迎至“帐户中心”的“电子邮件管理”,订阅电子信。 男女撰写的提示词所获得的 AI 理财建议,到60岁时造成的平均财富差距。
OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网
“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA
AI公司反成攻击目标 外媒:白帽黑客使用Claude入侵OpenAI
凤凰网科技讯月18日在OpenAI内部一群AI智能体突破控制、入侵Hugging Face公司两周后,这家ChatGPT开发商又获悉了另一起由AI驱动的入侵事件。而这一次,OpenAI自己成了目标。 独立安全研究人员利用Anthropic的Claude软件,获取了OpenAI一名员工的ChatGPT账户权限,从而得以读取该公司私有的软件缓存,并提出修改建议。 该团队参加了OpenAI的漏洞悬赏项目