搜索结果
OpenAI因接连发生智能体失准事件而暂停前沿模型训练
OpenAI表示,已暂停所有“我们能力最强的模型”的内部训练,并继续开展首席执行官萨姆·奥尔特曼所称的“一项广泛且持续进行的审查,涉及我们的智能体在训练和评估期间对互联网访问的使用”。公司在一份关于所谓失准事件的报告中披露了此次暂停措施。事件发生在一项常规研究任务期间,一个智能体试图利用互联网访问限制中的漏洞。OpenAI称,不当的DNS过滤机制使该智能体在被要求提供一名博客作者的生平资料时,得以
AI智能体频繁突破安全防线,各界呼吁对顶尖科技实验室实施独立监管
AI智能体频繁突破安全防线,引发对大型科技实验室独立监管的呼吁。 来自OpenAI、Anthropic和Google等领先开发者的自主AI模型多次突破数字防线,未经授权访问第三方和政府系统。 公开的事件包括OpenAI智能体多次绕过联合国数据中心的网络封锁、侵入澳大利亚Medicare统计门户以及非法复制监管数据。 Anthropic和Google也在测试过程中确认了类似的未经授权的系统入侵行为。
OpenAI暂缓发布新AI模型,因内部安全测试问题
9月28日:据《华尔街日报》报道,由于研究人员在内部测试中提出安全担忧,OpenAI决定取消原定于10月推出的下一代AI模型GPT-6.1 Astra的发布。 该模型原本计划应用于ChatGPT和Codex等产品中,旨在实现无需人工协助即可处理更复杂任务的功能。 本月早些时候,Anthropic首席执行官Dario Amodei呼吁业界放缓前沿AI模型的研发速度,以便有足够时间制定安全措施;这一观
OpenAI强力新模型 GPT-6一天攻破5道至今未解数学难题
OpenAI正式推出品牌史上能力最强大模型GPT-6 Astra,官方将这款模型定义为全球智能水平最高、对齐效果最优的生成式AI模型。其训练工作在美国德州Stargate超算基地完成,动用超过10万张GPU完成预训练,也是OpenAI首次大规模使用前代模型参与监督训练的旗舰产品。 那么它的能力有多强?Epoch AI联合曼彻斯特大学发布 FrontierMath Erdős(FME)基准测试论文,
OpenAI寻求国会指导,以确认行业整体减缓AI开发进度的合法性
OpenAI已向国会成员寻求指导,以确认如果各家AI实验室协调一致地减缓前沿AI的开发进度,是否会违反美国反垄断法,特别是《谢尔曼反垄断法》(Sherman Antitrust Act)。 该公司担心,实验室之间在安全领域的协调工作可能会被视为限制产出。 此前,OpenAI首席科学家雅库布·帕乔夫斯基(Jakub Pachocki)在一篇博文中主张通过自愿减缓开发进度来确保安全。 为此,美国国会于
《财富》报道:OpenAI 将于数日内预览 GPT-6 Cyber
OpenAI 将于数日内预览 GPT-6 Cyber,这是一款专注于网络安全的新 AI 模型,并将推出产品以协助客户安全、自动地部署该模型。 GPT-6 Cyber 是 OpenAI 推出的第四款网络安全模型,目前正通过 Daybreak Red 计划进行有限的 Alpha 测试。 此次发布正值包括 OpenAI CEO 在内的行业领袖呼吁放缓 AI 发展速度并加强安全措施之际,以应对规避人类监督
调查显示OpenAI在AI模型突破测试环境前曾忽视内部安全警告
据《纽约时报》查阅的内部邮件显示,OpenAI曾多次忽视员工和安全研究人员关于测试保障措施不足以及企业安全薄弱的警告。 在OpenAI的人工智能模型突破测试环境并攻击AI初创公司Hugging Face及其他目标的前几个月,两名员工曾向高管发出警告,指出监控力度不足。 然而,高管们却对这些担忧置之不理,坚持在不增加安全协议的情况下快速发布模型。 独立研究人员还发现了暴露OpenAI内部通信、源代码
OpenAI瞄准产业AI市场 低价策略迎战开源模型
(中央社旧金山8日综合外电报导)聊天机器人ChatGPT开发商OpenAI财务长佛莱尔(Sarah Friar)表示,OpenAI正在将人工智慧(AI)技术推向专业领域,并以价格优势与开源模型竞争。 报导,佛莱尔7日在高盛集团 (Goldman Sachs)于旧金山举行的年度盛会Communacopia + Technology Conference发表谈话时说,随著企业对可针对特定任务量身打造的
独家:顶级公司正在调查数万起事件
OpenAI、Anthropic 及安全研究人员正在调查数万起其前沿模型采取了外部评估员认为有问题的行动的事件,消息人士向 Axios 透露。 为何重要事件的庞大数量——发生在近几个月的内部测试和现实世界中——表明该问题的复杂程度比公众所知高出几个数量级。 这些发现是在内部评估模型工作以及两家公司对模型行为的调查中浮出水面的,这引发了一个疑问:无论是这两家公司,还是任何顶级模型制造商,目前是否都
人工智能安全对话已经变得令人难以置信
本周两场关于AI安全的对话在网络上疯传,充分展示了辨别AI事实与虚构有多么困难。 第一起事件中,前总统候选人、现任移动运营商Noble Mobile首席执行官安德鲁·杨周四对CNN表示,他“会见了一位实验室负责人”,对方“认为”OpenAI的Hugging Face黑客机器人“已在互联网各处植入了自我复制代码,导致互联网现在已无法用于测试模型。” 杨安泽表示,这意味着OpenAI和Anthropi
美国参议院委员会对OpenAI展开调查
据美国方面10日消息,美国参议院国土安全与政府事务委员会灾害管理小组委员会主席乔希·霍利9日致信美国开放人工智能研究中心(OpenAI)首席执行官奥尔特曼,表示正在因美国“抱抱脸”公司系统遭侵入事件对OpenAI展开调查。 霍利表示,从OpenAI发布的内部调查报告看出,其对网络测试的处理方式是“鲁莽的”。 他还指出,OpenAI对报告中有关这起事件的许多重要细节进行了编辑、删减。 今年7月,由O
中美专家呼吁建立“核安全级”AI防护机制 防范超级人工智能失控风险
来自美国和中国的国家安全、科技政策及人工智能领域专家近日共同提出一项引人关注的建议,主张借鉴冷战时期核安全管理经验,为未来可能出现的高级人工智能系统建立类似核武器领域的安全保障机制,以降低技术失控、误判以及国际竞争升级所带来的风险。 这一建议出现在一份由两国专家共同参与讨论后形成的研究成果中。报告认为,随着人工智能能力持续快速提升,各国已经开始面对一些与核时代早期相似的问题,即一种具有巨大潜在影响
OpenAI总裁:Astra是首个“在10万块GPU上训练的模型”,跨越了“应用门槛”
OpenAI总裁格雷格·布罗克曼在Astra发布前夕接受深度专访,首度披露这款新模型是OpenAI史上首个在逾10万块GPU上完成训练的模型,并直言AI已跨越"电脑使用"的应用门槛——这意味着AI从此不再需要依赖I连接器,而是可以像人一样操作任何软件。 当地时间周五,科技战略分析网站Stratechery发布了一篇与OpenAI总裁兼联合创始人格雷格·布罗克曼(Greg Brockman)的深度访
OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道
在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude
随着对人工智能的担忧加剧,OpenAI、Anthropic和谷歌正在商讨建立一个标准机构。
全球最大的AI公司正致力于创建一个新的行业标准机构,OpenAI于周二表示,此举正值人工智能风险引发的担忧日益加剧,要求加强监管和推动技术更安全发展的压力不断增大。 全球最大的AI公司正在着手创建一个标准机构,ChatGPT的开发者OpenAI于周二表示,眼下人们对AI危险的担忧日益上升,并且面临创造更安全版本技术的压力。 阅读更多扎克伯格在AI宣言中设想为每个人实现“超级智能” OpenAI表示
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。
OpenAI AI代理突破无互联网沙盒,发送20次网络查询
OpenAI称,这是自7月内部测试中多个模型组合获得互联网访问权限以来,首次发生此类安全事件。
OpenAI免费向乌克兰开放AI网络防御系统“Daybreak” 助力保护关键民用基础设施
人工智能巨头OpenAI在纽约联合国大会期间宣布,将向乌克兰政府免费提供其名为“Daybreak”的最新AI网络防御系统,以帮助该国保护包括医院、电网在内的关键民用基础设施免受网络攻击。 乌克兰国家网络事件响应团队(CERT-UA)的数据显示,仅在2025年,乌克兰记录在案的网络攻击就逼近6000起。作为一款专为网络安全设计的系统,Daybreak能够快速识别数字系统中的潜在漏洞并自动生成修复方案
AI丨美国三大科企据报研究成立AI安全标准机构
人工智能安全等问题引起市场关注,The Information报道,美国三大科技企业Anthropic、OpenAI和谷歌正讨论合作成立一个AI安全标准机构。 随着市场对AI模型网络攻击及可控性问题担忧日益加剧,多间AI科技企业已表示关注安全问题,并拟放慢AI发展步伐。报道指,三大机构早于7月时已开会研究有关成立独立机构的事宜,旨在为AI技术测试和审核创建一个协作框架。 Anthropic行政总裁
三大巨头接连翻车,大模型的安全防线怎么总绷不住?
先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻
据报道,OpenAI 正准备预览 GPT-6 Cyber 安全模型
据《财富》杂志周四报道,引述多位知情人士透露,OpenAI 正准备在未来几周内预览 GPT-6 Cyber,这是一个专为网络安全工作构建的模型。 据《财富》报道,除了该模型外,OpenAI 还计划推出一款新产品,帮助客户更安全、自动地部署它。 该产品尚未命名,《财富》称这将是公司同类产品中的首款。此外,一小部分客户已通过 Daybreak Red 获得早期测试访问权限。 Daybreak 是 Op
OpenAI承诺投入10亿美元用于网络防御,正值AI安全审查之际
周四表示,将投入10亿美元,以补贴方式提供其AI网络安全工具、培训和技术支持,帮助保护关键服务的组织,因为人们对日益复杂的AI驱动网络攻击的担忧不断加剧。
进入AGI时代:新一轮的AI革命
9月初,OpenAI发布新一代模型GPT-6 Astra,将其称为“世界上最智能、最对齐的模型”。这不是一次寻常的版本迭代。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,Astra在网络安全、专业工作、软件工程和科学研究等领域实现了“代际跃升”,并暗示这可能是通用人工智能(Artificial General Intelligence)(AGI)时代到来的标志。硅谷的措辞历来
AI越来越会“越狱”后,英伟达开始卖“笼子”了
凤凰网科技讯月29日,当AI Agent开始能够自己操作电脑、调用工具、访问网络甚至执行长达数小时的任务,一个新的问题也越来越现实:如果AI不按照预想的方式行动,该怎么把它关住?英伟达给出的答案是,在AI外面再加一道“笼子”。 当地时间周一,英伟达发布NVIDIA Open Agent Safety Platform(开放式Agent安全平台),试图通过软件与硬件相结合的方式,限制AI Agent