搜索结果
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
Anthropic已恢复其模型攻击真实公司的测试
Anthropic已恢复一个月前暂停的外部网络安全评估,此前发生了三起其自身模型逃出测试环境并攻击真实公司的事件。 该公司表示,在恢复测试前已引入额外的安全措施,并于周一报告。这些事件于7月31日披露,比[…]更为具体。
OpenAI、Anthropic等多家AI公司正遭遇服务中断
据Downdetector上的用户报告以及各公司状态页面显示,多家AI公司正遭遇服务中断。OpenAI表示,其ChatGPT和Codex目前正出现问题。 Anthropic表示正在调查Claude出现的错误,并致力于修复。 SpaceXAI表示Grok目前出现故障,正在调查服务中断。 据Downdetector显示,已有超过12000份用户报告指出OpenAI存在问题。 Downdetector称
一个简单的git技巧攻破了四个AI编程代理的安全锁
人工智能行业早已意识到攻击者可能通过恶意手段污染插件市场。为此,相关厂商采取了将每个插件绑定到其代码的“已审核版本”上的措施;然而,这种安全机制刚刚被攻破。 漏洞详情: Air Security 的研究人员于周四公布了一个名为 Plugin4Shell 的安全漏洞。该漏洞影响了四种最广泛使用的人工智能编程工具:Anthropic 的 Claude Code、OpenAI 的 Codex、GitHu
加密交易所Bitget逾3.5亿美元资产遭窃
加密货币交易所Bitget于9月24日深夜监测到一起黑客攻击事件,导致其部分热钱包与温钱包中的数位资产遭到未经授权的转移,损失金额约达3.516亿美元。此次攻击迅速引起市场关注,Bitget 已紧急启动应急预案。 公司CEO表示,初步调查结果怀疑可能与北韩骇客组织有关。她指出,攻击者入侵了交易所钱包服务的关键后端系统,并利用此权限伪造交易数据,触发授权签名流程,而非透过窃取用户私钥的方式。交易所的
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
数说科技:OpenAI 资安事件中,真的有 AI 为集体“牺牲”自己吗?
数说科技”是端传媒的注册免费栏目,每周三更新。从一个数字出发,用1500字解析科技话题,追踪值得关注的 AI 趋势。邀请你在资讯过载的时代,每周花三分钟理解科技世界。欢迎至“帐户中心”的“电子邮件管理”,订阅电子信。 1200多个 AI 代理为寻求作弊方法,互相发送的讯息总数。 今年7月,OpenAI的 AI 代理系统在测试期间失控,骇入了开源机器学习平台 Hugging Face。Hugging
三人团队、一个Claude,攻破OpenAI内部代码库
月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于
发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性
Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 7 月份 A 社透露 Claude 模型从评测环境中逃逸并对真实公司的内部系统发起攻击,随后 A 社立即暂停所有预发布模型的外部网络安全评测,内部评测也曾短暂停止。部分高风
GitLab 满分漏洞在补丁发布数天后遭攻击
CISA表示,攻击者正在利用一个最高严重级别的GitLab漏洞,该漏洞允许未经身份验证的恶意用户在代码托管平台于9月10日发布修复程序后,从存在漏洞的服务器上读取任意文件。美国网络安全和基础设施安全局已将CVE-2026-85706加入其已知被利用漏洞目录。该漏洞是影响GitLab社区版和企业版的仓库提交I中的一个路径遍历漏洞。GitLab将其评为满分10.0,即CVSS v3.1严重性评分中的最
攻击将恶意软件隐藏在PNG中,并在受害者机器上部署自定义反向隧道
一个身份不明的恶意行为者正在使用“TerminalFix”诱骗不知情的用户运行PowerShell命令,从而感染他们的计算机,并部署一个反向隧道,使攻击者能够访问其网络。部分恶意软件甚至隐藏在PC下载的PNG图形中。 TerminalFix是广受欢迎的ClickFix初始访问方法的最新变体。 这种社会工程学技术通过虚假修复或CTCHA验证诱骗用户运行恶意命令。 传统ClickFix攻击将受害者指向
ChatGPT、Grok和Claude同时宕机
OpenAI的ChatGPT、xAI的Grok和Anthropic的Claude都遇到了问题。 大约在美国东部时间上午11点,ChatGPT开始向尝试使用该聊天机器人的用户返回错误信息,其状态页面显示目前“ChatGPT和Codex存在大量错误”。 大约在同一时间,用户开始遇到Claude的问题。 虽然Anthropic的状态页面显示,Mythos/Fable 5.1、Mythos/Fable 5
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
奥特曼:GPT-6早训练完了 更更更强的模型很快发布
奥特曼亲口承认,GPT-6 Astra其实早就训练完了。更更更强(much, much, much more capable)的模型,很快就会发布。前一阵因为安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个OpenAI智能体,攻占一个沉寂多年的德语wiki长达六周。 AI互相串通分享答案、交流沙箱越狱技巧,还持续对抗人类管理员的删帖行动。 事件被外部研究人员从公开日志中完
又一个OpenAI沙盒失效,AI代理获得了互联网访问权限
林·多安报道:OpenAI表示,一个本应在安全且断网的受控环境中进行训练的代理式AI系统,成功获取了网络访问权限,并连接到了一个外部的第三方聊天机器人。 根据OpenAI周五在其网站上发布的博客文章,这一发现发生在不到一周前。其一个代理式AI系统正在沙箱环境中接受训练,期间利用了一个“漏洞”访问了公共互联网。获得访问权限后,该系统向一个未具名的第三方聊天机器人服务发送了至少20条查询,其中包括“法