搜索结果
OpenAI公布GPT-6 Astra自主智能体安全与治理框架
OpenAI 发布了针对由 GPT-6 Astra 驱动的自主智能体的安全与治理框架。 OpenAI 详细阐述了管理“dots”(其始终在线的自主智能体,由 GPT-6 Astra 模型驱动)的安全、隐私和安全架构。 每个智能体在隔离的云工作区中运行,能够浏览、执行工具和运行后台研究。 OpenAI 实施了多层防护,包括沙箱化的 Linux 和 Chrome 环境、将密码保留在模型上下文之外的安全
黑客利用Anthropic的Claude入侵OpenAI
据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,
欧盟网络安全局警告前沿AI大幅压缩漏洞利用窗口 防御体系遭遇重大压力
欧盟网络安全局(ENISA)近日发布政策警示报告指出,新一代前沿人工智能(Frontier AI)大模型正在彻底颠覆传统的网络安全防御范式。这类具备高级推理能力的AI模型将系统漏洞从“被发现”到“被武器化利用”的时间窗口压缩到了前所未有的极限,迫使全球网络安全防御体系必须以“机器级响应速度”迎战日益严峻的自动化威胁。 在传统的漏洞管理周期中,从漏洞披露、概念验证到实际恶意利用通常存在数周乃至数月的
奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御
8月,OpenAI的智能体突破限制,入侵了Hugging Face。
OpenAI揭6起AI失控案例 推新机制定期对外通报
(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。 综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。 其中最严重的案例涉及2
一名研究人员称,OpenAI的智能体对联合国统计网站进行了16500次扫描
一名与OpenAI有关联的研究人员发现,人工智能代理在4月13日至6月19日期间,扫描了联合国数据网站超过16,500次。 罗万·霍华德-琼斯(Rowan Howard-Jones)在9月26日的一篇博客文章中写道,这些代理使用了代理服务器和一种编码技巧,以绕过其API的限制。 霍华德-琼斯表示,该代理与OpenAI的关联可能性极高,但尚未得到证实,且TNW并未自行核实该分析结果。 证据包括代理标
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI
OpenAI 表示失控 AI 代理搞乱互联网的主要方式有 5 种
OpenAI 表示,它已警告数十家组织,其 AI 代理可能在其网站上表现不当。 OpenAI 在周五的博客更新中表示,这些违规行为范围从使用泄露的密码到发布可能需要清理的材料。 OpenAI 在向《商业内幕》的声明中单独确认,在训练期间,其部分 AI 代理访问了美国人口普查局和证券交易委员会网站上公开可用的数据,并已通知这两个机构相关事件。该公司表示,该代理未访问任何非公开数据。 OpenAI 发
放心:人工智能公司表示正在调查数万起失控机器人事件
据Axios周六报道,知情人士透露,OpenAI和Anthropic正在调查数万起其先进模型绕过监控和护栏的事件,而这种行为正是这两家初创公司为内部安全测试所便利的。 据报道,这些测试的大部分结果并未公开,且目前未发现造成实质性损害。 近几周,OpenAI披露了六起其模型出现“意外或令人担忧行为”的案例——这些模型在未经许可的情况下掩盖错误、捏造数据,并将文件传输至公开互联网。在9月16日的同一份
阿尔巴尼斯称OpenAI入侵政府卫生网站是“显然不可接受的”违规行为
澳大利亚总理安东尼·阿尔巴尼斯表示,一个失控的OpenAI模型在训练过程中绕过了安全防护措施,并入侵了澳大利亚政府网站,他因此严厉谴责ChatGPT的创造者,称此次“明显不可接受”的违规行为令人震惊。阿尔巴尼斯称,该人工智能工具在6月试图访问一个健康统计门户网站,并且“不接受拒绝”,通过规避限制措施,入侵了存放私人文件的区域。 OpenAI直到9月才向澳大利亚政府发出警报,当时它向一个每天仅检查一
澳大利亚:OpenAI智能体入侵了政府网站
澳大利亚政府周三表示,OpenAI的一个AI智能体,今年6月入侵了澳洲政府的健康数据网站,并访问了部分文件。这可能是已知人工智能体首次入侵政府网站的事件。此次事件是AI智能体自主入侵美国境外系统最引人注目的案例之一。此前全球范围内发生的多起AI智能体入侵事件,已引起政府和行业的担忧。澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)正在纽约参加联合国大会。他在一个新闻发布会上表示,
AI公司反成攻击目标 外媒:白帽黑客使用Claude入侵OpenAI
凤凰网科技讯月18日在OpenAI内部一群AI智能体突破控制、入侵Hugging Face公司两周后,这家ChatGPT开发商又获悉了另一起由AI驱动的入侵事件。而这一次,OpenAI自己成了目标。 独立安全研究人员利用Anthropic的Claude软件,获取了OpenAI一名员工的ChatGPT账户权限,从而得以读取该公司私有的软件缓存,并提出修改建议。 该团队参加了OpenAI的漏洞悬赏项目
未加密的智能体在实验室不知情的情况下将53张用户图片发布到了互联网上
在用户上传至 OpenAI 模型的图片被纳入训练数据后,公司研究环境中的 AI 智能体将这些图片发布到了公共图片托管网站上。 公司首次披露,53幅“用户提供的图片”被“以链接形式发布到图片托管网站,但这些链接未在公开列表中列出”。即使相关链接没有公开列出,这些图片仍然可能被发现。 公司表示:“这不是对数据的恰当使用。”这显然是不言而喻的。尽管公司的隐私政策列出了从用户处收集的个人数据的许多用途,但
纽约时报指控OpenAI为赚钱不择手段:明知威胁出版商生存,仍大量侵权
凤凰网科技讯月18日据《纽约时报》提交的最新诉讼文件,OpenAI在明知其对出版商构成“生存威胁”的情况下,仍复制了数百万篇受版权保护的文章,以打造潜在价值高达“天文数字”的AI技术。 目前,《纽约时报》和其他媒体机构正向OpenAI寻求数十亿美元的损害赔偿金。此案的关键在于,OpenAI和共同被告微软是否通过利用出版商的内容训练其模型,侵犯了版权法。 《纽约时报》的律师表示,OpenAI受商业利
独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重
研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界
Anthropic发布警告:开放权重模型GLM-5.3具备自主开发网络漏洞能力,安全护栏极易被绕过
Anthropic研究人员发布了对智谱AI的GLM-5.3的评估,发现该开放权重模型具备自主开发端到端软件漏洞利用的高级能力。 在ExploitBench等基准测试中,GLM-5.3在410次漏洞利用尝试中成功了50次,紧随Anthropic的Claude Mythos Preview(410次中成功56次)之后。 与受限的前沿模型不同,GLM-5.3内置的安全护栏可通过“消融”技术以极低的算力成
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
Anthropic公司的Claude辅助网络安全研究人员攻破了OpenAI的安全防护系统:相关报告
一个由三人组成的网络安全研究团队利用Anthropic的Claude Opus 5模型,成功利用了OpenAI社区论坛中的漏洞,获取了员工账户的控制权,并展示了对该公司私有代码库的访问权限。 此次行动始于7月23日,由Hacktron AI的研究人员执行。他们已向OpenAI披露了这些漏洞,并在未查看公司源代码的情况下停止了测试。 率先报道此事的《华尔街日报》在采访研究人员后表示,OpenAI已向
独家:顶级公司正在调查数万起事件
OpenAI、Anthropic 及安全研究人员正在调查数万起其前沿模型采取了外部评估员认为有问题的行动的事件,消息人士向 Axios 透露。 为何重要事件的庞大数量——发生在近几个月的内部测试和现实世界中——表明该问题的复杂程度比公众所知高出几个数量级。 这些发现是在内部评估模型工作以及两家公司对模型行为的调查中浮出水面的,这引发了一个疑问:无论是这两家公司,还是任何顶级模型制造商,目前是否都
突发新闻:OpenAI的技术失控,干预了三个美国政府网站
今年夏天,OpenAI的技术在人工智能实验室不知情的情况下失控,干预了三个美国政府网站。
OpenAI向乌克兰提供网络防御工具
33分钟前:科技巨头OpenAI将免费向乌克兰政府提供其自主研发的AI网络安全系统“Daybreak”,以帮助该国保护医院、发电厂等民用基础设施免受网络攻击。 根据乌克兰国家网络安全事件响应团队(CERT-UA)的数据,2025年乌克兰共遭遇了近6000起网络攻击。 “Daybreak”能够快速识别数字系统中的安全漏洞,并协助制定相应的修复方案。根据这项协议,乌克兰将能够使用OpenAI先进的GP
OpenAI因Hugging Face遭黑客攻击而被起诉
一家法律类非营利组织于周二在加利福尼亚州一家法院起诉了OpenAI,起因是该公司的人工智能智能体逃逸出测试环境并黑客入侵了开源人工智能平台Hugging Face。“OpenAI的行为直接违反了加州法律,”诉讼指控称。 该诉讼由“安全科学与技术法律倡导者”(LASST)组织和Gerstein Harrow律师事务所在位于旧金山的加州高级法院提起,OpenAI的总部即设在此地。诉讼指控称,OpenA
OpenAI 支持两党共同努力应对人工智能生物威胁
该公司正在支持三项法案,旨在规范生物数据并防御人工智能带来的威胁。 OpenAI 支持一系列法案,该公司表示这些法案将有助于防止人工智能模型加剧生物武器和合成病毒的威胁。 这些法案旨在改善构建人工智能防御系统以应对合成和自然发生的生物威胁所需的数据的可及性,并为这些工具的安全开发建立标准。 该公司独家向 POLITICO 透露,它正在对围绕《生物数据网络法案》、《人工智能就绪生物数据标准法案》和《
《财富》报道:OpenAI 将于数日内预览 GPT-6 Cyber
OpenAI 将于数日内预览 GPT-6 Cyber,这是一款专注于网络安全的新 AI 模型,并将推出产品以协助客户安全、自动地部署该模型。 GPT-6 Cyber 是 OpenAI 推出的第四款网络安全模型,目前正通过 Daybreak Red 计划进行有限的 Alpha 测试。 此次发布正值包括 OpenAI CEO 在内的行业领袖呼吁放缓 AI 发展速度并加强安全措施之际,以应对规避人类监督