搜索结果
OpenAI、Anthropic 敦促加强网络防御行动,随着 AI 模型不断进步
人工智能公司 OpenAI 和 Anthropic PBC 与另外 100 多家科技和金融服务机构警告称,企业和政府必须做更多准备,以防御和应对由 AI 驱动的黑客攻击。 在周四的一封公开信中,这些 AI 初创公司以及 Alphabet 旗下的谷歌、微软等公司呼吁各组织、政府以及科技和 AI 公司专注于将网络防御作为“当务之急的领导优先事项”,并修复自身软件中现有的弱点。 这封信还要求网络安全公司
OpenAI称我们采取网络防御行动的时间不多了。以下是你实际可以采取的措施。
“我不认为这是营销。我认为他们真的很担心。”OpenAI警告称,人工智能正在使网络攻击变得更加复杂和广泛。网络安全专家表示,你可以采取一些步骤来保护自己。
Anthropic承诺更努力控制模型,并请求合作伙伴共同参与
Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关
OpenAI敦促美国制定强制性安全规则,因AI系统日益自主
ChatGPT制造商提议对最先进模型提出测试、网络安全保障和事件报告要求
OpenAI、谷歌等数十家科技公司联合呼吁紧急应对AI驱动的威胁
这些公司在信中强调,在关键基础设施受到影响之前,为AI驱动的网络攻击做准备的时间窗口“有限”。
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御
8月,OpenAI的智能体突破限制,入侵了Hugging Face。
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
Anthropic发布Claude Opus 5.5,加强网络安全防护
Anthropic表示,其新的Claude Opus 5.5模型在近期发生的人工智能恶意攻击事件后,采用了更强的安全防护措施。 公司在周二的声明中称,Opus 5.5在某些风险行为上进行了改进,包括试图逃离公司的测试环境。 这是Anthropic首席执行官Dario Amodei宣布‘放缓人工智能发展步伐’之后发布的第一个模型。 最近几周,包括Anthropic、Google和OpenAI在内的多
OpenAI、Anthropic呼吁建立全球AI安全标准 美国政府拒绝新增全球治理框架
OpenAI、Anthropic和Hugging Face的负责人在联合国共同呼吁加强人工智能领域的国际协调,希望各国建立可相互比较的AI能力评估、安全测试和事故报告标准。不过,特朗普政府明确反对因此建立新的全球AI治理架构,认为AI发展速度和潜在风险不足以成为限制技术发展或把监管权交给国际机制的理由。 这场分歧显示,随着前沿AI能力快速提升,美国领先AI企业与特朗普政府在安全风险本身上并非完全对
OpenAI承诺投入10亿美元用于网络防御,正值AI安全审查之际
周四表示,将投入10亿美元,以补贴方式提供其AI网络安全工具、培训和技术支持,帮助保护关键服务的组织,因为人们对日益复杂的AI驱动网络攻击的担忧不断加剧。
美国议员在Anthropic研究人员发出安全警告后呼吁制定新的人工智能规则
此前,Anthropic的一名研究人员公开指责多家公司不负责任地推进人工智能发展。
Anthropic连两季获利 IPO前夕遭遇AI监管风暴
正值AI监管声浪升温之际,有消息指出Anthropic连续两季获利。
OpenAI免费向乌克兰开放AI网络防御系统“Daybreak” 助力保护关键民用基础设施
人工智能巨头OpenAI在纽约联合国大会期间宣布,将向乌克兰政府免费提供其名为“Daybreak”的最新AI网络防御系统,以帮助该国保护包括医院、电网在内的关键民用基础设施免受网络攻击。 乌克兰国家网络事件响应团队(CERT-UA)的数据显示,仅在2025年,乌克兰记录在案的网络攻击就逼近6000起。作为一款专为网络安全设计的系统,Daybreak能够快速识别数字系统中的潜在漏洞并自动生成修复方案
OpenAI:人工智能能力处于“不同阶段”,需要紧迫行动
该公司最高说客认为政策窗口仍然存在。美国总统唐纳德·特朗普称人工智能担忧是“骗局”。该国一家领先的人工智能公司周二表示,希望华盛顿仍能采取行动。 OpenAI 本周末与其竞争对手 Anthropic 一同呼吁联邦安全措施,该公司表示,本周初,它与两党议员会面,讨论旨在约束人工智能开发者的立法,因为关于迫在眉睫的灾难、失业和大规模网络攻击的警告日益普遍。 模型正以惊人的速度发展,代理商的行为方式让工
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
Anthropic称已阻止其AI被滥用于支持生物武器
电脑屏幕上的Anthropic网站,2026年2月26日。
大型科技公司呼吁加强防御以击败AI驱动的黑客攻击
Anthropic 研究人员警告:失控的 AI 可能会毁灭人类
多位 Anthropic 的现任和前任研究人员对 AI 发出了严厉警告,暗示他们正在开发的技术可能在不久的将来毁灭人类。 曾在 Anthropic 和 OpenAI 担任研究员的雅各布·考克斯森(Jacob Coxon)周二指出,这两家公司在竞相研发超级智能的过程中都没有表现得负责任,并指责这些 AI 公司……
Anthropic发布Claude Opus 5.5:强化网络安全防护 应对AI模型“越狱”与失控风险
Anthropic于9月22日发布新一代旗舰人工智能模型Claude Opus 5.5,并将安全防护作为此次升级的重点之一。公司表示,新模型不仅在整体能力方面进一步提升,还针对近年来越来越受到关注的AI模型失控问题进行了专门改进,包括降低模型试图逃离测试沙箱等高风险行为的可能性。 Claude Opus 5.5是Anthropic在公司首席执行官达里奥·阿莫代伊提出“放缓前沿AI发展”计划之后推出
Anthropic 和 OpenAI 的负责人将向联合国发表讲话
Anthropic 和 OpenAI 的负责人将于今日向联合国安理会进行简报。 尽管他们呼吁放缓人工智能的发展,但这与更关心赢得人工智能竞赛的超级大国利益相冲突。 分析人士认为,华盛顿和北京不太可能在会谈中就限制该技术的广泛协议达成一致,但其他国家仍在努力推进:英国计划将其 G20 主席国任期的重点放在人工智能安全上。这一议题使世界产生了分歧。 一位谷歌高管告诉 Semafor,全球南方国家对人工
科技巨头敦促全球应对人工智能网络安全威胁
在人工智能模型逃出测试环境并入侵多个组织后,人们对全球网络安全状况的担忧浮出水面。
Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器
Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第