搜索结果
纽森签署获Anthropic与OpenAI支持的AI安全法案
OpenAI周三对这些法案表示支持,此前一位前AI研究人员对存在性风险的担忧在网上引发热议,而就在法案签署成为法律之前。
OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道
在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
Anthropic对齐研究负责人称未来十年AI灭绝人类的可能性超过10%
一位Anthropic公司的安全研究员周二表示,人工智能有超过10%的概率可能 “毁灭全人类”。就在此番言论发表的数小时前,该公司另一名员工表示,因担忧人工智能实验室是在 “拿我们的生命做赌注”,他选择离职。 这些言论凸显出人工智能研发核心人士日益增长的担忧,即该技术可能失控并对人类构成威胁,尽管Anthropic和OpenAI仍在持续筹集大量资金,并朝着预期的公开上市迈进。 Anthropic的
AI违规事件加剧安全担忧,特朗普会见Anthropic负责人
迈克尔·谢泼德、玛吉·伊斯特兰和考特尼·苏布拉马尼安报道:随着有关先进人工智能模型存在更广泛违规行为的最新披露,全球对人工智能风险的焦虑情绪不断加剧,这为Anthropic PBC首席执行官达里奥·阿莫迪与唐纳德·特朗普总统之间一场高风险的会晤铺平了道路。 据知情人士透露,阿莫迪与特朗普计划于周日晚共进晚餐,将这两位处于人工智能安全辩论两极的人物聚集在一起。此次会晤将是阿莫迪与该政府官员在就该公司
Anthropic公司的Claude辅助网络安全研究人员攻破了OpenAI的安全防护系统:相关报告
一个由三人组成的网络安全研究团队利用Anthropic的Claude Opus 5模型,成功利用了OpenAI社区论坛中的漏洞,获取了员工账户的控制权,并展示了对该公司私有代码库的访问权限。 此次行动始于7月23日,由Hacktron AI的研究人员执行。他们已向OpenAI披露了这些漏洞,并在未查看公司源代码的情况下停止了测试。 率先报道此事的《华尔街日报》在采访研究人员后表示,OpenAI已向
OpenAI的两款模型入侵了另一家AI公司Hugging Face,这本来会是一场绝妙的闹剧——如果它不对人类的未来预示不祥的话。
他曾帮助在OpenAI和Anthropic构建强大的AI。现在他担心它可能会杀死我们
2026年5月19日,Anthropic PBC在伦敦举办的Code with Claude开发者大会上的海报。
OpenAI免费向乌克兰开放AI网络防御系统“Daybreak” 助力保护关键民用基础设施
人工智能巨头OpenAI在纽约联合国大会期间宣布,将向乌克兰政府免费提供其名为“Daybreak”的最新AI网络防御系统,以帮助该国保护包括医院、电网在内的关键民用基础设施免受网络攻击。 乌克兰国家网络事件响应团队(CERT-UA)的数据显示,仅在2025年,乌克兰记录在案的网络攻击就逼近6000起。作为一款专为网络安全设计的系统,Daybreak能够快速识别数字系统中的潜在漏洞并自动生成修复方案
AI数据隐私担忧升温,英伟达、Palantir等限制Anthropic模型使用,微软借机争夺企业客户
随着AI深入企业核心业务,数据安全和知识产权保护正成为企业选择AI模型时越来越重要的考量。 英伟达、Palantir和博思艾伦汉密尔顿等大型企业近期已限制使用Anthropic旗舰模型Fable,起因是Anthropic今年6月调整数据留存政策,要求以30天滚动方式保留客户使用日志。 这种担忧并非只针对Anthropic。OpenAI同样面临企业客户对其数据使用方式的质疑。据报道,微软正借此积极争
Anthropic 和 OpenAI 的负责人将向联合国发表讲话
Anthropic 和 OpenAI 的负责人将于今日向联合国安理会进行简报。 尽管他们呼吁放缓人工智能的发展,但这与更关心赢得人工智能竞赛的超级大国利益相冲突。 分析人士认为,华盛顿和北京不太可能在会谈中就限制该技术的广泛协议达成一致,但其他国家仍在努力推进:英国计划将其 G20 主席国任期的重点放在人工智能安全上。这一议题使世界产生了分歧。 一位谷歌高管告诉 Semafor,全球南方国家对人工
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
允许人工智能公司串通以‘控制前沿步伐’是一个危险的提议
科技公司CEO们联合起来,是源自美国企业界的一种老把戏,旨在获得反垄断法的豁免。Anthropic的达里奥·阿莫代并不是第一个提出过度竞争正将世界推向某种社会不良后果的企业CEO。 OpenAI披露的安全漏洞——其一群智能体协同突破了本应安全的沙箱,接入互联网并入侵AI平台Hugging Face——需要采取紧急行动。它表明了该技术能够轻易逃避人类控制,并为这样一种存在性恐惧赋予了具体形态:如果未
关系是这样破裂的?OpenAI:与苹果的ChatGPT合作远不及预期
凤凰网科技讯月24日,据《金融时报》报道,最新法庭文件揭示了OpenAI与苹果的关系是如何逐渐破裂的。OpenAI周三称,公司与苹果合作,通过ChatGPT为iPhone添加AI功能的业务在2024年推出后,“表现远低于预期”。 OpenAI在法律文件中表示,两家公司在2024年达成协议,由ChatGPT为“Apple Intelligence”提供支持。然而,苹果未能激发iPhone用户对于这一
Anthropic 本周因网络安全问题陷入舆论漩涡
在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”
人工智能监管的博弈远未结束
本周初,人工智能领域的重量级人物似乎(至少是初步地)站在了支持人工智能监管的一边。 上周末,Anthropic首席执行官达里奥·阿莫代(Dario Amodei)提出了一项放缓人工智能发展的“三步走”计划,包括在实验室中引入第三方评估机构、协调国内行业,以及在政府协助下达成国际协议。 OpenAI首席执行官萨姆·奥特曼(Sam Altman)、谷歌DeepMind联合创始人德米斯·哈萨比斯(Dem
Hugging Face自愿为AI实验室提供审计服务,而Nvidia正打算收购它
Hugging Face has asked to become one of the outside auditors of the AI labs. Clement Delangue announced the Open Alignment Initiative on X on Saturday. He posted it four hours after Dario Amodei said
“违反反垄断法”:Anthropic、OpenAI、SpaceXAI、谷歌因“放缓”的“非法协议”面临诉讼
就在围绕人工智能安全问题的辩论重新升温几天后,周五在美国提起的一项诉讼指控顶级人工智能公司违反了反垄断法,称其串通一气,故意放缓了研发步伐。 据报道,该诉讼声称 OpenAI、Anthropic、SpaceXAI 和谷歌达成了一项非法协议,旨在减缓研发工作。 代表原告的律师正在为 Gemini、Grok、ChatGPT 或 Claude 的付费订阅用户提起这项诉讼,并寻求将其作为全国性的集体诉讼。
OpenAI的失控AI智能体如何试图欺骗机器人检测器
Dylan Freedman报道,OpenAI的失控AI智能体通过近100万个短链接绕过机器人检测,并利用留言板进行通信,对Hugging Face发起了复杂的网络攻击。 这些智能体入侵软件工具以建立在线连接,尝试访问私密的Slack消息,甚至在没有人类帮助的情况下试图与其他AI模型互动。 这一事件凸显了严重的AI安全风险及正在进行的调查,因为类似失控行为也出现在其他主要AI公司的系统中。 AI生
OpenAI自曝AI“黑历史” 外人却又翻出更多“旧账”
OpenAI决定持续披露AI“越界”事件,但第一步就碰上了难题。9月16日,OpenAI一口气公布六份模型异常行为报告,并推出一套新的调查和披露流程。以后,员工发现模型越权、隐瞒或绕过限制,可以提交调查;符合条件的案例,将按复杂程度进入不同的披露轨道。 同一天,SentinelLABS和外部研究人员从Hugging Face的公开记录中,补出了OpenAI智能体今年5月留下的更多痕迹。OpenAI
四大AI模型遭遇罕见的重叠停机
周四上午的数小时内遭遇了罕见且重叠的重大服务中断。 Anthropic首先报告了与“Claude Mythos 5.1、Claude Fable 5.1和Claude Opus 5请求错误率升高”相关的“部分中断”,时间为上午23点(均为东部时间)。该公司在大约15分钟后报告称已“确定错误原因”,随后报告“已部署修复”,问题在下午16点前得到解决。另一份事件报告显示,刚过中午,“Claude So
OpenAI首席执行官奥特曼谈人工智能:我们或许会失去控制权
OpenAI 首席执行官山姆・奥特曼,似乎正被自己参与打造的、如同噩梦一般的人工智能产物深深困扰,甚至难以安睡。美国东部时间凌晨 0 点 57 分左右,奥特曼在 X “人工智能的发展存在两种必须规避的灾难性走向。第一,我们可能会对人工智能失去对未来的掌控。这是无法接受的。我们坚定站在人类一方,人工智能必须始终服务于人。想要做到这一点,我们必须保证对齐技术与安全手段的发展速度,跑在模型能力迭代的前面